{"as_of":"2026-08-13T18:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05dc562d367bd34e4e121efb7ce923f51220d45727e2825b0c207b90ce98f8f4","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:52:51.209612Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.10381/citation-record","integrity":"/paper/2412.10381/integrity","json":"/paper/2412.10381/citation-record.json","paper":"/paper/2412.10381"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:50.901529Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.901529Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:4f4230d95b2c1e5aad15d2def4ee2cb4d5f8a986755d2ac0ef7bb5b18cb2cc6d","observation_id":"64f099f3-d1f3-4328-8012-531c454297fb","resolution":{"observed_at":"2026-08-12T10:52:50.901529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.369786Z","title":null,"venue":null,"work_id":"fe64f356-e6ee-470b-b6fb-b05a18f5e3b2","year":2021},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.907979Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:36f381de35acf048add9dbe9a4a1dd152e8605f275b832f9f66a86fb72b10f8f","observation_id":"1fff39fd-578e-4e45-acd4-03e000d6abd1","resolution":{"observed_at":"2026-08-12T10:52:52.376885Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.348599Z","title":null,"venue":null,"work_id":"5d655664-4dfb-4c3c-9019-0f5871bde7b8","year":2017},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.913593Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:b2c1cf0f2bf1a5f00e35634fbdb9a1a3650eb070b0eb7e8cee24caef75243d8e","observation_id":"01d9a52f-8e31-4e17-82b0-193706de622d","resolution":{"observed_at":"2026-08-12T10:52:52.355104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-12T08:59:05.030983Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-12T10:52:50.919588Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.919588Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:535bde0f159ba8daa34725092a7ed72de68fbce268c75bedae5834b3a8b46d34","observation_id":"9065f912-361a-4080-a59c-89582523c400","resolution":{"observed_at":"2026-08-12T10:52:50.919588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.328373Z","title":null,"venue":null,"work_id":"5bf6d895-092e-43f3-8f27-a1f9b6e769fe","year":2023},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.926219Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:e37f64f56c833e7e25ba8911c130719a5e21ca04a92d695aeaa07fbd52a87922","observation_id":"457ce9d4-3850-4ac9-8573-b0578d12aed4","resolution":{"observed_at":"2026-08-12T10:52:52.335055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.302403Z","title":null,"venue":null,"work_id":"1ed1b80c-3f74-4c02-bcd3-b399ed029a82","year":2020},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.931939Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:48893f0c4d89feb61a3f43dafa9ddb5b9a99c017a28ab5c9418c6a30085ff89f","observation_id":"cb652757-3e23-4d7a-ad9a-7df23c1216fb","resolution":{"observed_at":"2026-08-12T10:52:52.308969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.276021Z","title":null,"venue":null,"work_id":"3662cd27-4ce1-48d0-979c-9f2d5875ab8a","year":null},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.938389Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:b3de3e14604dc6689550651257a3980b51a490223777fd9daeacbcc99ae4ec14","observation_id":"dee0befc-c6ff-4548-845e-ce42d33ee679","resolution":{"observed_at":"2026-08-12T10:52:52.288283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03732","last_updated":"2019-10-09T00:45:53Z","snapshot_observed_at":"2026-08-13T07:21:34.908078Z","submitted_at":"2019-10-09T00:45:53Z","title":"Ctrl-Z: Recovering from Instability in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1910.03732","doi":null,"metadata_source":"pith","pith_arxiv_id":"1910.03732","snapshot_observed_at":"2026-08-12T10:52:51.606925Z","title":"Ctrl-Z: Recovering from Instability in Reinforcement Learning","venue":"cs.LG","work_id":"064558ea-7e6e-400b-9887-f56cb2e9d90f","year":2019},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.950100Z"},"links":{"cited_paper":"/paper/1910.03732","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:03e0a62b6319dcda8de8e7b99ccf25f323db5f529e639181b59d3b87f84e5bda","observation_id":"a9908d34-5b8a-4ceb-b493-7461b271111a","resolution":{"observed_at":"2026-08-12T10:52:51.616774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.256261Z","title":null,"venue":null,"work_id":"0f150a55-de42-4704-b0b3-107a24edd9ed","year":null},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.955840Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:b71bf7a35d59be29e57d00cb7d18d20544c08f88f5bf0f8a009506439cdbf33b","observation_id":"e57e0058-f304-4c05-bc30-16dc62bbca8a","resolution":{"observed_at":"2026-08-12T10:52:52.261799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.208300Z","title":null,"venue":null,"work_id":"7bbb7680-2d6f-4b71-b0da-1d9f80e81634","year":2023},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.969876Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:d7372b39826317f455d37440a7cdadd4bc6c9eda25b9acd5702aa82e5e48f751","observation_id":"cc3a6e52-a5f8-4c7f-9da5-5d5ed96e69d8","resolution":{"observed_at":"2026-08-12T10:52:52.215296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.02011","last_updated":"2016-01-20T10:33:00Z","snapshot_observed_at":"2026-07-06T04:38:59.730187Z","submitted_at":"2015-12-07T12:25:18Z","title":"How to Discount Deep Reinforcement Learning: Towards New Dynamic Strategies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.02011","snapshot_observed_at":"2026-08-12T10:52:50.975419Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.975419Z"},"links":{"cited_paper":"/paper/1512.02011","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:adb5fc850ea00a7341adbddda807eba97a4922eded29e38b7408a5f56aadc2a9","observation_id":"e87f761e-5451-4632-8dc7-05c2491bfcf2","resolution":{"observed_at":"2026-08-12T10:52:50.975419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:50.981032Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.981032Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:76a409d733bf53fbe865ea26e57d6e4a460fc2aac0ffe4fb76429cb9f3f5098c","observation_id":"430a1f3e-aa52-48e5-9780-1553eb46451b","resolution":{"observed_at":"2026-08-12T10:52:50.981032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:50.986616Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.986616Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:3c44139d1c060fce1a4af63592bcef81385bca835da4c170d3ba6c1fe22ec4ed","observation_id":"a9ec3a37-7a2f-4e26-81e7-3cb8cc67aae1","resolution":{"observed_at":"2026-08-12T10:52:50.986616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:50.994745Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.994745Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:506964ed14ea92985de382beae1a6807c3e1dd8555e916861abc725b9377b2cc","observation_id":"56b63171-ae52-4571-b2dd-dc2b1dd07f9a","resolution":{"observed_at":"2026-08-12T10:52:50.994745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.146235Z","title":null,"venue":null,"work_id":"7ad71d6a-9376-41dd-b8c0-d2a0407bccca","year":2004},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.999753Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:7957ae13e000ecca64e15f70c677897a42b34f9ba76d929a6129a8be193b3b83","observation_id":"89f5ebd3-5c39-4406-87e7-c4aeb4e1b1c5","resolution":{"observed_at":"2026-08-12T10:52:52.153821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.005598Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.005598Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:d4dada1412882f0bdfe9859db7a640c3e86dd846a9d082832de4dfd47be0d86c","observation_id":"3ab226f2-bbe4-4cbe-96ea-99c62b875988","resolution":{"observed_at":"2026-08-12T10:52:51.005598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.112191Z","title":null,"venue":null,"work_id":"723fbfd0-3e1c-4de4-94c9-3b81f63fd260","year":null},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.012045Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:4482c26bcfad5c7f3b4b50d027a343eb62ad185d7309dd3d7aa3ca54ca495b94","observation_id":"efeb99d1-5b41-4865-b5f1-0bd44608f900","resolution":{"observed_at":"2026-08-12T10:52:52.118216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-12T10:52:51.025778Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.025778Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:49bc89a3e374b85c6e0084e332efc1a5a5ceebabebe30b816de58e6e22632359","observation_id":"0fc87e8f-8cb7-4931-9698-422295d5a1e4","resolution":{"observed_at":"2026-08-12T10:52:51.025778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.032200Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.032200Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:a6d0e3c5bf37ce6526fcf949147d6ee34d82943e0f72d1ed927d2c9834dcd71c","observation_id":"4d466631-606a-4787-98f1-62ae1c57ea18","resolution":{"observed_at":"2026-08-12T10:52:51.032200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.037671Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.037671Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:89cda11d1f7e77f8ef0496174b6249967367a0f6c76b58474eabc7806cb303d5","observation_id":"a7b9165d-6a91-4a6b-be18-0445fc3677dc","resolution":{"observed_at":"2026-08-12T10:52:51.037671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-01T18:34:23.156273Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-12T10:52:51.042612Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.042612Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:5fe178f81e70a2ee54ee6f9de4e85385756a7d3b3936d138a2c44afeb0cbf0c3","observation_id":"b2eea160-de8b-4fd3-adac-3e3160e27180","resolution":{"observed_at":"2026-08-12T10:52:51.042612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T10:52:51.048052Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.048052Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:0d75ae0fd059dd0f12ba1a3dd8d9f63f84278ac62aaece07ac052127628ed5d4","observation_id":"20950dc5-63a0-4ffc-a921-a17b4d6c62b7","resolution":{"observed_at":"2026-08-12T10:52:51.048052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-13T07:57:56.087944Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-12T10:52:51.053319Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.053319Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:ebbf8224feab54b24d1b08798b119c4b4c16f3c8df939025b11a46a5c313754c","observation_id":"e5fbd000-6110-4d7c-be91-894da1a99800","resolution":{"observed_at":"2026-08-12T10:52:51.053319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.059103Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.059103Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:b107b74c3f73c79823c01c97eab8d87b43962b3e92700c3e197cfca636a2fc2c","observation_id":"741ced39-92a4-4f54-8655-da519eea2461","resolution":{"observed_at":"2026-08-12T10:52:51.059103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07274","last_updated":"2018-11-26T04:56:31Z","snapshot_observed_at":"2026-08-13T10:40:41.947431Z","submitted_at":"2017-01-25T11:52:11Z","title":"Deep Reinforcement Learning: An Overview","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07274","snapshot_observed_at":"2026-08-12T10:52:51.064060Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.064060Z"},"links":{"cited_paper":"/paper/1701.07274","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:10f056bd825de4c5c25700d6c4c00909a8264057c30a0d760792463bb4e546d8","observation_id":"acc28442-5077-4a70-9de7-9417e2acb2c1","resolution":{"observed_at":"2026-08-12T10:52:51.064060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.070010Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.070010Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:0f94943dcd7bb74faafdb33aa8fb9e1e4536b1399122604bf593c68176eb8ca2","observation_id":"2a6dd38e-38a7-4e52-912c-c1b06da17367","resolution":{"observed_at":"2026-08-12T10:52:51.070010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-12T10:52:51.075855Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.075855Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:f73883f326d7182df9cb93d2e08b24a46edee8f27ea260eb55e6489be34cddc6","observation_id":"0bc94022-93e2-4ce4-97aa-c2acd243c02a","resolution":{"observed_at":"2026-08-12T10:52:51.075855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.081802Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.081802Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:82e6af0c753aba7d493d9287705a3864480a672ebb7761bf4d320bcbf362b82f","observation_id":"39d264af-7691-4e38-bed8-49246624be64","resolution":{"observed_at":"2026-08-12T10:52:51.081802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02264","last_updated":"2019-02-27T05:38:15Z","snapshot_observed_at":"2026-08-10T11:21:32.818759Z","submitted_at":"2018-07-06T06:03:06Z","title":"Variance Reduction for Reinforcement Learning in Input-Driven Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02264","snapshot_observed_at":"2026-08-12T10:52:51.086889Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.086889Z"},"links":{"cited_paper":"/paper/1807.02264","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:d561b7fd0ad1fb987e4b6fce65c59dd5f3de33730eb3473d2ce20ca3df116519","observation_id":"2608cd96-7ecc-4ac7-856d-af1e39f510aa","resolution":{"observed_at":"2026-08-12T10:52:51.086889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.976696Z","title":null,"venue":null,"work_id":"97077b8e-03b4-433f-bdc6-161e1de5c6a2","year":2021},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.092765Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:527ba76b71bd20404961feb48ae11b945cc21076bd4f44caf52eaaf8dd570964","observation_id":"9f327761-2654-4db4-b769-26483708a99e","resolution":{"observed_at":"2026-08-12T10:52:51.983097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-12T14:28:10.961989Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-12T10:52:51.098648Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.098648Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:0410d685c82ff3f6dd23073825d61bcf1c59354c0f63c6b127f43b273fe37c3a","observation_id":"b18907ed-d891-4c8a-b115-96566cc2ec24","resolution":{"observed_at":"2026-08-12T10:52:51.098648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.105407Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.105407Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:981100e5f37381b7c26be2d83fd9eb548814fcfd6c364159d59621b7fa0e3970","observation_id":"194adf29-264a-4641-adf2-90e49a3de292","resolution":{"observed_at":"2026-08-12T10:52:51.105407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-12T10:52:51.111006Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.111006Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:0deeef15d08d82f3d339f88d3c9f7227e923b138a00892cebb2f9174bcad82df","observation_id":"b491901a-80f8-419d-bf49-58afb7e334e5","resolution":{"observed_at":"2026-08-12T10:52:51.111006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.03359","last_updated":"2018-11-07T20:36:53Z","snapshot_observed_at":"2026-08-04T20:32:26.661813Z","submitted_at":"2018-05-09T03:11:29Z","title":"Reward Estimation for Variance Reduction in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.03359","snapshot_observed_at":"2026-08-12T10:52:51.116862Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.116862Z"},"links":{"cited_paper":"/paper/1805.03359","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:e3601b60f58d00585f6e40f6bc5f898ff36f2336b1459a26351916948af52418","observation_id":"93686276-b083-4f0c-9aeb-d98005ba99b9","resolution":{"observed_at":"2026-08-12T10:52:51.116862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.943206Z","title":null,"venue":null,"work_id":"7020274c-97f8-432c-98b1-0bf06fec957c","year":2022},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.122380Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:399755f63632d198b1d4c5db03cc9c1e0a35596d2e753feda3dd0cbc8cf460b0","observation_id":"c205711a-8b0c-4f28-a82f-8d27c1ccf97a","resolution":{"observed_at":"2026-08-12T10:52:51.950675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.127482Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.127482Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:ebe486021b34df8d07b4b2b953605001c02dcc5d5b90c2f490e9b30d8edf57c1","observation_id":"aedf5ca5-e001-47a5-b4e8-65adedda267c","resolution":{"observed_at":"2026-08-12T10:52:51.127482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.905715Z","title":null,"venue":null,"work_id":"2bc63dce-6f5d-48bf-8db0-cb1eceb28740","year":2015},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.132451Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:669f02cb0d58b690dad41edd7ada139e81b47ea7d002bb993c85d73cd8aa5eb9","observation_id":"0e668155-11ca-4a0b-a9b3-57c0c80c826c","resolution":{"observed_at":"2026-08-12T10:52:51.912380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11074","last_updated":"2018-12-26T11:09:40Z","snapshot_observed_at":"2026-08-07T08:33:38.128537Z","submitted_at":"2018-05-28T17:31:11Z","title":"Reward Constrained Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11074","snapshot_observed_at":"2026-08-12T10:52:51.137747Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.137747Z"},"links":{"cited_paper":"/paper/1805.11074","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:5d3741dc8e83f5b6d6ac86add523e867633355fe366a2b45e87c3e96ce42dfb1","observation_id":"5a53ca29-5fb1-4347-acf2-d8777189d23b","resolution":{"observed_at":"2026-08-12T10:52:51.137747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06355","last_updated":"2022-12-13T03:38:57Z","snapshot_observed_at":"2026-08-13T13:23:03.818353Z","submitted_at":"2022-12-13T03:38:57Z","title":"A Review of Off-Policy Evaluation in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06355","snapshot_observed_at":"2026-08-12T10:52:51.143142Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.143142Z"},"links":{"cited_paper":"/paper/2212.06355","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:72d676f9038f52f0f28f1d34056f1ceca0cc9b4fe7b1636fcd55be3d0c85213e","observation_id":"28cd3a95-016f-47d2-9b2e-0b0a0477d58e","resolution":{"observed_at":"2026-08-12T10:52:51.143142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.148713Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.148713Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:22f61de573d08697e208b069f2ded10fdf761d78deeee8d5cde35b7deed4b62b","observation_id":"9c748270-b810-4f92-ac84-43be5e3880e6","resolution":{"observed_at":"2026-08-12T10:52:51.148713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.153745Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.153745Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:2fa4272fefbd1d72b1ab43df2aa32e82c32a0fdf973a4406ce715c68a9cc813b","observation_id":"251134e3-50d4-4779-a7da-62f0010ccbdf","resolution":{"observed_at":"2026-08-12T10:52:51.153745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.855631Z","title":null,"venue":null,"work_id":"88055f8b-6bfc-4cae-86c5-6623657a408f","year":1989},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.159424Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:a73fc0736291848845e6fbee9ba79a5a4e11c822f543a9ed4801bd39396e6448","observation_id":"21cd8c86-7b44-492a-b115-a1a615dae295","resolution":{"observed_at":"2026-08-12T10:52:51.861876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.164950Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.164950Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:2acc2ba6bef067debd269c8f89813c9bdd914c7513481611344f2e8e38630d4d","observation_id":"bd92e0f2-d732-4f1a-b64c-f726ef3eff4b","resolution":{"observed_at":"2026-08-12T10:52:51.164950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.822809Z","title":null,"venue":null,"work_id":"45acea7e-0f45-4190-98d6-7cb346d905d2","year":2023},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.169848Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:335cf8a6d1344c474ad0a7ef996f12bda7e498c3ec6704b0b21a1f1cf485228c","observation_id":"5c500e15-1983-4475-8205-c2f384c432dc","resolution":{"observed_at":"2026-08-12T10:52:51.828248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.802717Z","title":null,"venue":null,"work_id":"b0f2f225-9598-49cc-8fda-081d074482a3","year":2024},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.175416Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:588151fc103e2dc06c51243f5718b0d4cc2d8721aa57e10a55365b8e22593969","observation_id":"525c036a-c1b7-427d-9eeb-e88e6470e9d0","resolution":{"observed_at":"2026-08-12T10:52:51.808445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.780669Z","title":null,"venue":null,"work_id":"1f866432-c383-442a-a27a-a04cdf46f2a9","year":2024},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.181118Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:de7e1050ef6c374a193a20742f6e9deaa6433b5267970a2fd55a5c31990daf0e","observation_id":"ebe34c84-972f-4a3c-957b-fee4860a82e0","resolution":{"observed_at":"2026-08-12T10:52:51.787780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.754489Z","title":null,"venue":null,"work_id":"099273f8-6329-44ef-b6b3-6a4621b7c53b","year":2022},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.186571Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:9335c90c109bed2f21d522e333fb3fca977dd1f54a412d1b34116a4147aeac00","observation_id":"cdcbc178-addf-4ce1-b378-c66dd9573a49","resolution":{"observed_at":"2026-08-12T10:52:51.765193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.192265Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.192265Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:2a5255b8a35322c5166ccb12db07709c8d66b1e6d3a13316d1014530cd1af2a3","observation_id":"ab8ac462-96d3-4e36-8936-6978ae73220c","resolution":{"observed_at":"2026-08-12T10:52:51.192265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.197266Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.197266Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:14511cd23038c3f5db629720c87878fc91dbd70866105bd284b4b58e408c4057","observation_id":"39e049ec-bdd2-4489-abaf-0b81759f2b43","resolution":{"observed_at":"2026-08-12T10:52:51.197266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.202675Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.202675Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:fc756305d304a5d46c2ee2a3eeb83ba470de4b93ccc887bfc43ff83b21c43731","observation_id":"27bc7b36-aa05-4d8b-b158-e70682cdce24","resolution":{"observed_at":"2026-08-12T10:52:51.202675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:51.677879Z","title":"In Proceedings of the 25th ACM SIGKDD international conference on knowledge discovery & data mining","venue":null,"work_id":"8818e521-659a-452a-b5de-8b1830192dc8","year":2025},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.209612Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:51f0918d8c1aa9ecc53ce758eead118242ac2303fd3028d5a1103c4bfe91ae7c","observation_id":"04983ac8-997e-42c4-874c-1700b0970e6f","resolution":{"observed_at":"2026-08-12T10:52:51.685360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.084139Z","title":null,"venue":null,"work_id":"5c596c3d-bf14-431f-8ca6-da993f4c0add","year":null},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:51.018329Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:fd35e34917a99b15af74a4f84bd512b5166517d8868bab516cc3ea8688cb3ce2","observation_id":"d52705de-123a-4afb-9a1a-ae044374a580","resolution":{"observed_at":"2026-08-12T10:52:52.090556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-13T14:15:08.132615Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-08-12T10:52:50.944478Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.944478Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:e568538b6b201f9700d87b58ac5febd057d9d37e346d49541d98100a9cbd1ef8","observation_id":"ea992a80-c1bd-4a3e-9791-c4d206ad2e72","resolution":{"observed_at":"2026-08-12T10:52:50.944478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:52:52.232588Z","title":"In Pro- ceedings of the Sixteenth ACM International Conference on Web Search and Data Mining","venue":null,"work_id":"a60095c7-3336-4fac-ab18-6a2a4d946adc","year":null},"citing_paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed","version":6},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T10:52:50.962597Z"},"links":{"citing_paper":"/paper/2412.10381"},"observation_digest":"sha256:46e89d31d1ac6872965cd585e5ad9174545110e9249f5ef5639106244d176d2e","observation_id":"34f6c823-0c9c-4129-990d-424bd042b821","resolution":{"observed_at":"2026-08-12T10:52:52.241482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.10381","last_updated":"2025-05-26T03:49:37Z","latest_version":6,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-13T07:21:07.679051Z","submitted_at":"2024-11-28T04:06:02Z","title":"Supervised Learning-enhanced Multi-Group Actor Critic for Live Stream Allocation in Feed"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2412.10381."}