{"as_of":"2026-08-16T20:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6177c1850f357ab02bd9baef33950ff5194fd0c63f76210b983250c1de26534","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:01:08.600180Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14125/citation-record","integrity":"/paper/2506.14125/integrity","json":"/paper/2506.14125/citation-record.json","paper":"/paper/2506.14125"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.252800Z","title":"Constrained policy optimization","venue":null,"work_id":"98b79d8d-2bba-44e8-b101-582a5e89d80f","year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.396381Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:aed00eefbaab99a4935caf100d2040763ea4548e27d42496c589d11609a9835f","observation_id":"5be75a55-5d9c-4f6e-a65e-ce76b800917e","resolution":{"observed_at":"2026-08-15T20:01:09.256897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.238904Z","title":"Safe reinforcement learning via shielding, 2017","venue":null,"work_id":"252da1b5-273d-4300-b8eb-e2d3232b4d59","year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.401174Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:3fb7f3e25ed9a8752e24cb8081f03b03581c87cebdbbe3a27a6dc01bfd8858c5","observation_id":"05f4c639-5402-4d0c-9e39-eb0f1b9d5967","resolution":{"observed_at":"2026-08-15T20:01:09.243510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.224524Z","title":"Asymptotic properties of constrained markov decision processes","venue":null,"work_id":"f13d8417-515b-4403-86cd-8bca6d69670c","year":1993},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.405566Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:b015695d021bb1a54e5ead4d0eb66c2380adabc9d5ab1af4c5a2ef31030edb7f","observation_id":"1d364716-2cde-46eb-9fbd-d48e60177199","resolution":{"observed_at":"2026-08-15T20:01:09.229000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.211275Z","title":"Deep reinforcement learning for demand response in distribution networks","venue":null,"work_id":"28739599-3204-43b4-a9d5-9530b14b28bb","year":2020},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.410077Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:48372f1dd2887b291baad30a4e399598071e6c8de4ba3165839771a02e18dce8","observation_id":"4c69894e-990d-4215-be53-24a5235ab0b3","resolution":{"observed_at":"2026-08-15T20:01:09.215622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.197479Z","title":"Dynamic allocations for multi-product distribution","venue":null,"work_id":"1199ac03-bb50-413e-b015-2f8037e0f899","year":1995},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.414520Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:121cf3e0bfe471f9e37ee800efc534db7f51ed8cdb41ca00d61d96a85a926032","observation_id":"7e3fd9b3-e9a8-407e-a3c0-638221a2a80f","resolution":{"observed_at":"2026-08-15T20:01:09.202202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.184242Z","title":"Deliveries in an inventory/routing problem using stochastic dynamic programming","venue":null,"work_id":"d68d86f5-b4b0-4eec-b3c4-a4915bd6e3f3","year":2001},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.418841Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:255ed9c37f5c50ec3b0bbad5373b078b916aa717d29700e60f5a410bffdc752c","observation_id":"ba30aaeb-4974-4d4b-90e1-479690a6b11b","resolution":{"observed_at":"2026-08-15T20:01:09.188578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.171209Z","title":"Resource constrained deep reinforcement learning","venue":null,"work_id":"7f3fb405-c4d9-40f0-9ff3-98a646769b11","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.423605Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:f9efaee3b161d3cda0c861a87b05d12c0cdbd9a9e0db8719731ba943a09e3ab6","observation_id":"0e48722e-60d5-4a7f-be11-af9e8544ea56","resolution":{"observed_at":"2026-08-15T20:01:09.175242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09583","last_updated":"2019-11-06T21:41:06Z","snapshot_observed_at":"2026-08-15T23:38:38.526029Z","submitted_at":"2019-02-25T19:41:06Z","title":"Duality between density function and value function with applications in constrained optimal control and Markov Decision Process","version":3},"cited_work":{"arxiv_id":"1902.09583","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09583","snapshot_observed_at":"2026-08-15T20:01:08.753450Z","title":"Duality between density function and value function with applications in constrained optimal control and Markov Decision Process","venue":"eess.SY","work_id":"b8138eec-3704-4560-866a-1be1f2d7669f","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.427952Z"},"links":{"cited_paper":"/paper/1902.09583","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:c8181e5fbddb0788f512a5df9068b7bc648788f8c791b86baa459b0e38b669b0","observation_id":"7910ef68-b089-4069-b9cd-2697d104341e","resolution":{"observed_at":"2026-08-15T20:01:08.759910Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.432595Z","title":"A tutorial on kernel density estimation and recent advances","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.432595Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:6357cc248bf8302caefe1e95bee34ad22115c6bd360ac95cd659e97e54bb881e","observation_id":"12714306-cb76-499b-9d89-0877225c6f86","resolution":{"observed_at":"2026-08-15T20:01:08.432595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.150205Z","title":"Supervised fuzzy reinforcement learning for robot navigation","venue":null,"work_id":"29659128-b0ee-4d07-a2a8-07e3e59fd070","year":2016},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.436678Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:68e99d0acc3b0f2fc81d3e94f24af42c2738fef419a738b8888f5985251a70a9","observation_id":"7995c69f-1974-48c2-9d0b-468dcc0d49a7","resolution":{"observed_at":"2026-08-15T20:01:09.153865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.138661Z","title":"A comprehensive survey on safe reinforcement learning","venue":null,"work_id":"4919bf42-61d9-4410-85a9-29aad38daf91","year":2015},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.440861Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:f61b6f0db0c2940f81e4134515f4f0cf1772cedcda7dd07b79e086c9ad9f2925","observation_id":"41d4d7a9-e90b-488a-b1c9-a3cff33419b5","resolution":{"observed_at":"2026-08-15T20:01:09.142245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.127215Z","title":"Fuzzy q-learning","venue":null,"work_id":"fad08922-b0f3-40d9-a01e-90590858431a","year":1997},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.445200Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:84ae72c464ceb9c6c62708967a7cb6686da17d9324f7d8f4649779ece63d331e","observation_id":"ba56ffb1-40e2-42e6-9208-98fb0ce15ca4","resolution":{"observed_at":"2026-08-15T20:01:09.130738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.115626Z","title":"Deep reinforcement learning for robotic manipulation with asynchronous off-policy updates","venue":null,"work_id":"87391162-30d1-48c8-adf4-d672451afe1b","year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.449306Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:aa88e964bdd4faeed4996d69e90aa7bf13926cb1fcdae7f23927fea4dae2cef5","observation_id":"de379194-4561-4849-b674-b63d3bf68da1","resolution":{"observed_at":"2026-08-15T20:01:09.119336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-16T16:58:50.532049Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-15T20:01:08.453440Z","title":"A review of safe reinforcement learning: Methods, theory and applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.453440Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:5674cf874798402ed8b2fc527dc5e06880b2cdeac654d44b0274840baf5bafc2","observation_id":"14b093ad-91a2-433a-9ab2-e4d41e255575","resolution":{"observed_at":"2026-08-15T20:01:08.453440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08550","last_updated":"2020-11-03T05:46:51Z","snapshot_observed_at":"2026-08-10T20:40:57.457282Z","submitted_at":"2020-02-20T03:36:39Z","title":"Learning to Walk in the Real World with Minimal Human Effort","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08550","snapshot_observed_at":"2026-08-15T20:01:08.458090Z","title":"Learning to walk in the real world with minimal human effort","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.458090Z"},"links":{"cited_paper":"/paper/2002.08550","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:bca547d479876525c0c4e9b04d4169e3c15990ab5db5cd249f415fd485c9ba15","observation_id":"88062e48-5473-4e2f-9530-f51adaf64026","resolution":{"observed_at":"2026-08-15T20:01:08.458090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.103195Z","title":"Hierarchical reinforcement learning for scarce medical resource allocation with imperfect information","venue":null,"work_id":"aaf35f24-9034-4359-ad08-6fa97e8ef82a","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.462602Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:dae6a96d3a388087a88e37b441e7f2c043ac882010af05f998fc593c02ab0f9a","observation_id":"e3590007-a40a-422f-b7af-b26cb61e6b52","resolution":{"observed_at":"2026-08-15T20:01:09.107394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.08099","last_updated":"2019-02-16T18:11:58Z","snapshot_observed_at":"2026-08-15T23:37:26.174402Z","submitted_at":"2018-01-24T17:50:30Z","title":"Logically-Constrained Reinforcement Learning","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.08099","snapshot_observed_at":"2026-08-15T20:01:08.466900Z","title":"Logically-constrained reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.466900Z"},"links":{"cited_paper":"/paper/1801.08099","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:00ece10fc5f164075bb48c3e7b79b2a8a05b128f0de428a86f5a7525c91ee280","observation_id":"5e5fb747-f99f-4985-bc58-65a0d267616a","resolution":{"observed_at":"2026-08-15T20:01:08.466900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.090213Z","title":"Deep reinforcement learning with temporal logics","venue":null,"work_id":"18e31312-8046-4a26-886d-caf34c630107","year":2020},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.471573Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:4545dcc525c2d58d86ea072b10a6ca667b4522a20230063f8378b58e7696e18a","observation_id":"82d539d9-c5d4-48c0-8671-88ab9ef72d1a","resolution":{"observed_at":"2026-08-15T20:01:09.094339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.077272Z","title":"Achieving sustainable supply chains through energy justice","venue":null,"work_id":"cb8c2d00-7545-44ab-8700-f8d7c6682dfd","year":2014},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.475627Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:9e3d058c82c2786286433806fdddee144c18fcead797cf95445400d98bf06a6d","observation_id":"89b97076-1a54-444e-a2d5-24564f2123b0","resolution":{"observed_at":"2026-08-15T20:01:09.081515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.064177Z","title":"Line: Logical query reasoning over hierarchical knowledge graphs","venue":null,"work_id":"7186db05-3fcb-49b9-8e8f-ec83e3f62994","year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.479956Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:015fad3346738f148f998031150662df0a16cec485636344401797b40731b044","observation_id":"202b9f2b-0152-4143-9156-db1170c6accc","resolution":{"observed_at":"2026-08-15T20:01:09.068577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.051304Z","title":"America's strategy to secure the supply chain for a robust clean energy transition","venue":null,"work_id":"711654c4-946e-4c80-997c-7a9aa6684e08","year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.484102Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:43da9bc55419383a9f5a7be2adc838b2d98c97f65a1231091ab424b6bd7a23d5","observation_id":"8cdda88b-b8b6-45c6-9a1a-92f9d296e6da","resolution":{"observed_at":"2026-08-15T20:01:09.055482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.038305Z","title":"Community-based operations research","venue":null,"work_id":"8f34d7a7-c6f0-46ce-909e-1afe3129528c","year":2007},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.488583Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:fdbf88ca6ffccb43ec88d6167281f63e205903c7f2fe7023f91c92eb00454d55","observation_id":"2084936b-8d76-41c1-99e3-3d9a89687a1e","resolution":{"observed_at":"2026-08-15T20:01:09.042539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.025148Z","title":"On bayesian index policies for sequential resource allocation","venue":null,"work_id":"82f34fd5-1f38-4a3b-9fc5-706d45e5ffd5","year":2018},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.492684Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:7f05908cc4109c42e4e2e84a848fe8919a4f51d3a4b7d427b7ccfa983f5b93a7","observation_id":"302212df-a0a1-43b2-b284-e203a09e1a88","resolution":{"observed_at":"2026-08-15T20:01:09.029257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.012320Z","title":"Between steps: Intermediate relaxations between big-m and convex hull formulations","venue":null,"work_id":"4e8af46e-9427-4fda-877a-976578b571e9","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.496825Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:95c8dde876df4d1272caf1c9f937f2d5ad6a6b97b59fe73cbfadfc54c0d0a738","observation_id":"578cea17-3554-4b64-aeaa-41ceb3b279b5","resolution":{"observed_at":"2026-08-15T20:01:09.016571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.06298","last_updated":"2020-08-19T19:08:51Z","snapshot_observed_at":"2026-08-14T16:15:27.814749Z","submitted_at":"2019-06-14T17:10:42Z","title":"Augmenting Neural Networks with First-order Logic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.06298","snapshot_observed_at":"2026-08-15T20:01:08.500522Z","title":"Augmenting neural networks with first-order logic","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.500522Z"},"links":{"cited_paper":"/paper/1906.06298","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:41144d4924453507df316922ef6dc030b766c83796a2be84f519aee0c943ccc5","observation_id":"c825ee03-52fb-44b7-bb5f-73b2dfd2e703","resolution":{"observed_at":"2026-08-15T20:01:08.500522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08560","last_updated":"2024-08-22T05:05:13Z","snapshot_observed_at":"2026-08-16T15:00:20.681996Z","submitted_at":"2023-09-15T17:28:06Z","title":"Deep Reinforcement Learning for Efficient and Fair Allocation of Health Care Resources","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08560","snapshot_observed_at":"2026-08-15T20:01:08.504544Z","title":"Deep reinforcement learning for efficient and fair allocation of health care resources","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.504544Z"},"links":{"cited_paper":"/paper/2309.08560","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:4b8b33ac1a63762219dbeea4a3480dcfb0a399cad5cab2b7838723c768e3cf44","observation_id":"6264bf78-637d-498b-91e9-5fc8dca917e0","resolution":{"observed_at":"2026-08-15T20:01:08.504544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.998473Z","title":"Sequential resource allocation for nonprofit operations","venue":null,"work_id":"b409b993-1d60-416d-b5af-364f8dd393da","year":2014},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.508841Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:a18c49acbfae52313aa93cc002d5df9a5191aeb71bc805040564a35da5f22ca1","observation_id":"a607d748-7a27-4367-9403-1aa91efb3936","resolution":{"observed_at":"2026-08-15T20:01:09.002610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.986316Z","title":"Clara: A constrained reinforcement learning based resource allocation framework for network slicing","venue":null,"work_id":"7b55bfe1-69fb-413a-9a11-b7c4399a3fff","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.513144Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:28e021ce69445b2b41c0024a2a7b012252cd6df0dc9eaf3a9539d030bc5a7949","observation_id":"de61594b-3e94-43e1-b4d1-acbcbb0dfcc0","resolution":{"observed_at":"2026-08-15T20:01:08.990043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.974364Z","title":"Adaptive sequential surveillance with network and temporal dependence","venue":null,"work_id":"11e8fce6-5723-4048-9edf-41fa748ac984","year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.517342Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:aa703380079fde8c386ea604a60ebcf0aa3343ee8eef388a8eebd467e08c0702","observation_id":"e973397e-f8a5-414d-9a06-5aebaba24179","resolution":{"observed_at":"2026-08-15T20:01:08.978102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.962339Z","title":"Ethical resource allocation in policing: Why policing requires a different approach from healthcare","venue":null,"work_id":"6013de6b-0d1b-4d24-a5f1-87a01c02c235","year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.521491Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:9ecd3aa9fe70fa74189b0fb82bc18f078d7e12aeedac967200cee189c9a0d987","observation_id":"80454cf3-ccc6-4a8d-b12b-b88fdd8c7b20","resolution":{"observed_at":"2026-08-15T20:01:08.966400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.950512Z","title":"A primal dual formulation for deep learning with constraints","venue":null,"work_id":"fbbf01c3-4de0-4836-9c9f-42a9539a7719","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.525778Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:8b2b23eb87b3a29478c6f0444c20591533fc685cb5c4d7b55a7dc47eae05bfd6","observation_id":"acc5a0ff-d3ef-48f5-ba61-29a15f77d610","resolution":{"observed_at":"2026-08-15T20:01:08.954186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.937888Z","title":"Deep reinforcement learning approach for capacitated supply chain optimization under demand uncertainty","venue":null,"work_id":"9cf4897f-7d83-4594-81e6-95632d553dac","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.529994Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:2dafab6f56409b498b3f837151cead5bd08391350500d2115377763e6763c0ea","observation_id":"b7567450-0cc4-47cc-a7f3-979a69769425","resolution":{"observed_at":"2026-08-15T20:01:08.942113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.924353Z","title":"Combining fuzzy logic and reinforcement learning for resource management in edge computing","venue":null,"work_id":"e547f725-ca09-4be5-acd0-7fc07ef4c566","year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.534280Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:4929df5b3fcfb5b582a5d5d09e4c511d1f265055f170202dc4975fc7278837d9","observation_id":"92c40bbb-04a0-47f4-9bd7-c59d718e438c","resolution":{"observed_at":"2026-08-15T20:01:08.928679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.911293Z","title":"Fairness of the distribution of public medical and health resources","venue":null,"work_id":"324e31f2-465d-40ba-bd80-df3dd95ddde9","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.538381Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:35781acd638b6b2baff3a9a06338b812fc1c77eda9dbf653e02835c56db2065d","observation_id":"1dfc4132-eedb-4c26-8214-c3b69eec8098","resolution":{"observed_at":"2026-08-15T20:01:08.915694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.898520Z","title":"Density constrained reinforcement learning","venue":null,"work_id":"f52626d2-7273-46b2-96e0-7704f737b9e7","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.542300Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:afc0c6537e4f55e6d02b64d2fa99651a2b9ef6a0e6a321fb7a6ce2cc3569f7f1","observation_id":"27eb12f5-e496-440d-a687-bebfd19efc97","resolution":{"observed_at":"2026-08-15T20:01:08.902621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.885361Z","title":"A dual to lyapunov's stability theorem","venue":null,"work_id":"b4c0e6c8-6eeb-45ec-91ce-b8027afddfa3","year":2001},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.547582Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:ae96b4b823119fa1023e91a3defee4c09fb95725d0352ea1f9ed710e6c11377b","observation_id":"a0b9784c-736f-40ce-88d7-21c4d9e15602","resolution":{"observed_at":"2026-08-15T20:01:08.889428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.872323Z","title":"Benchmarking Safe Exploration in Deep Reinforcement Learning","venue":null,"work_id":"83d11a12-f3c9-4523-9038-f6d669a6174a","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.551759Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:2810726d4a66f83ff77a1822748c49f09fccf6bbcfcf53a5b3075bcbbc5346f6","observation_id":"38398143-cf84-4274-b7c1-9790afab83c2","resolution":{"observed_at":"2026-08-15T20:01:08.876651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05969","last_updated":"2020-02-29T03:59:06Z","snapshot_observed_at":"2026-08-13T17:30:03.547401Z","submitted_at":"2020-02-14T11:20:10Z","title":"Query2box: Reasoning over Knowledge Graphs in Vector Space using Box Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05969","snapshot_observed_at":"2026-08-15T20:01:08.555712Z","title":"Query2box: Reasoning over knowledge graphs in vector space using box embeddings","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.555712Z"},"links":{"cited_paper":"/paper/2002.05969","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:3c5543fb70415902224b6fb5ceaf450efc8562f17916d807210af2095339ad23","observation_id":"2f1b0077-17c1-4454-9540-4155843d11e5","resolution":{"observed_at":"2026-08-15T20:01:08.555712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.858302Z","title":"Apprenticeship learning using linear programming","venue":null,"work_id":"a491a0cd-63ab-4668-ad9b-7265dcb3f9f1","year":2008},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.560069Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:df31c2fa18e34e27a5f0271207e2744381bb0b41804e901d5e9d97f06833f9c2","observation_id":"133b02cf-616d-496b-90e0-9e10b66e26d4","resolution":{"observed_at":"2026-08-15T20:01:08.863196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.843736Z","title":"The impacts of the covid-19 traffic light system on staff in tertiary education in new zealand","venue":null,"work_id":"56a5a452-a097-47b5-bfe8-d92e266e22d0","year":2023},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.564114Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:65dc1ec42482ce4c75299f1f9b9fe4f9a0baf0c537014f179ff7fca5220e0f55","observation_id":"c9d9f0ca-6b92-4be6-b98f-a1c9cd5c8665","resolution":{"observed_at":"2026-08-15T20:01:08.848622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11074","last_updated":"2018-12-26T11:09:40Z","snapshot_observed_at":"2026-08-14T19:10:15.765536Z","submitted_at":"2018-05-28T17:31:11Z","title":"Reward Constrained Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11074","snapshot_observed_at":"2026-08-15T20:01:08.568016Z","title":"Reward constrained policy optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.568016Z"},"links":{"cited_paper":"/paper/1805.11074","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:154632aff1b8f8bf9ce714661b367ff3dc3428a887a83c8df3804429851603e8","observation_id":"fe46283b-7b35-440a-9ffd-8a00c8395dcc","resolution":{"observed_at":"2026-08-15T20:01:08.568016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.829260Z","title":"Improved big-m reformulation for generalized disjunctive programs","venue":null,"work_id":"646d0aab-588d-469b-89bb-c924e9e8b63e","year":2015},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.572065Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:6fa90a310c9e0fda1947d913984711fb65ebd075f083fa1b12a070355b819b9c","observation_id":"a1bfcaee-d873-4fde-ad75-fd784cc5df72","resolution":{"observed_at":"2026-08-15T20:01:08.833735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.815570Z","title":"Disjunctive programming techniques for the optimization of process systems with discontinuous investment costs- multiple size regions","venue":null,"work_id":"8db260bd-c781-4c6d-b2ec-b1d224e40bcf","year":1996},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.576006Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:7d5c6a519de3747d81d2deb72e7f84f4dd606864193f6257e4c97e0000e6ab78","observation_id":"9222da3e-c6b5-4756-a7ef-3f0fdf7b288c","resolution":{"observed_at":"2026-08-15T20:01:08.820024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.802860Z","title":"Dynamic shielding for reinforcement learning in black-box environments, 2022","venue":null,"work_id":"5043146d-c2f5-414d-a0d8-35bfe03d973e","year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.580100Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:f4edf741b178b4d1a8612d17d441478fc822fdfd50152f1a953f03f80a0ba86a","observation_id":"ea06e07e-2147-4ac1-b132-57ad133fc53d","resolution":{"observed_at":"2026-08-15T20:01:08.806624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14758","last_updated":"2024-04-15T13:44:11Z","snapshot_observed_at":"2026-08-16T14:24:17.929668Z","submitted_at":"2024-01-26T10:33:38Z","title":"Off-Policy Primal-Dual Safe Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14758","snapshot_observed_at":"2026-08-15T20:01:08.584153Z","title":"Off-policy primal-dual safe reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.584153Z"},"links":{"cited_paper":"/paper/2401.14758","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:87844fe49c10cd7cf871fe4f07dfd013dd604a3a9fa18a2879e8246bc1af89c2","observation_id":"d1e43745-4fb0-4697-8826-476cac56d1cc","resolution":{"observed_at":"2026-08-15T20:01:08.584153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-16T19:15:19.794542Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-15T20:01:08.588304Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.588304Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:0d2467f111e4ab2e581579f8b3fbb9b9af86c6c96a45544edfbafac6ea9a8cf3","observation_id":"311564d5-b7e6-4960-aa54-f66b851479f6","resolution":{"observed_at":"2026-08-15T20:01:08.588304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.790690Z","title":"Learning density-based correlated equilibria for markov games","venue":null,"work_id":"5632205f-cff9-42a2-a1b3-692adb4bea56","year":2023},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.592377Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:63b66de7b205335ea88c7dbb2ee03173777ecaa017e5adcabd6552cd0892eeba","observation_id":"eb4687ca-97ae-4ace-86ec-c1b1c18c5817","resolution":{"observed_at":"2026-08-15T20:01:08.794529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.778092Z","title":"The energy injustice of hydropower: Development, resettlement, and social exclusion at the hongjiang and wanmipo hydropower stations in china","venue":null,"work_id":"8acef1c3-9e23-4e9a-aa01-415a95b064e2","year":2020},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.596286Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:29c31c0cdd7c6fc2b9eb2add37010e221e650b4701e6b9d7ab7a43cdde59b09d","observation_id":"96cf58b7-de99-4668-9312-c989ccffde74","resolution":{"observed_at":"2026-08-15T20:01:08.782022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.600180Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.600180Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:b37ec337b5428f774d6f0d1bfe4db1b4bde9158cf3c112e90887a275b570b208","observation_id":"824a5941-4552-4a73-bb4b-6e728d9cc9b9","resolution":{"observed_at":"2026-08-15T20:01:08.600180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":37},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2506.14125."}