{"as_of":"2026-08-06T22:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3f910c223c5a06d903c8fda78415deaca43ffcb5454556f25281bc921102fa3","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:51:02.003627Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.04225/citation-record","integrity":"/paper/2508.04225/integrity","json":"/paper/2508.04225/citation-record.json","paper":"/paper/2508.04225"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:08.554817Z","title":null,"venue":null,"work_id":"680845fb-174a-4f3d-b24b-3894e93ec50d","year":2017},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.037208Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:8411f37dfdca27f6de20529e1d9e9f6badd7fde05efc32cd4974ba50f40d7272","observation_id":"3585c6d8-e22e-4636-a74a-b99bda04f062","resolution":{"observed_at":"2026-08-06T00:51:08.640158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:08.325254Z","title":null,"venue":null,"work_id":"92c3ac21-9f41-445d-be95-33e28d1bcc14","year":2025},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.102776Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:462189105aea4915e99a9d7f9efaca9c265e8f593b4e36937125dfa4dac4e192","observation_id":"2eab9191-ebbe-40f7-ac20-91469f90e63b","resolution":{"observed_at":"2026-08-06T00:51:08.396167Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:08.111242Z","title":null,"venue":null,"work_id":"a75fc6a9-14a8-487b-8816-9b3c25b7500a","year":2017},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.190874Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:05188a8cdddf26641122ef1e023d20c44e80b499aa22bca388f1dba09897af0d","observation_id":"4367b36f-7193-4a94-87c6-5bb2cece3c06","resolution":{"observed_at":"2026-08-06T00:51:08.220245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5448.13454","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:02.904195Z","title":null,"venue":null,"work_id":"74c29d59-969b-48df-b7d3-9ed3a201ed0e","year":2007},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.236626Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:e42129faaddca36720ac51cacf29847d171456014c542274744d5d590ecff7d0","observation_id":"85eb11d2-85f2-4f8d-b090-536341e2a2a9","resolution":{"observed_at":"2026-08-06T00:51:02.989016Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:07.866123Z","title":null,"venue":null,"work_id":"ba76622e-7003-49d5-9d1d-44fcc695eece","year":2023},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.271272Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:a2cc8506a0e847e098b696b61d067ae09d04663d67636aff99da7cb5901ce194","observation_id":"3cdf0f60-a339-4f20-8488-0c6c5af36fba","resolution":{"observed_at":"2026-08-06T00:51:08.000681Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:07.654156Z","title":null,"venue":null,"work_id":"e54d731a-7cb2-4fc2-807f-914e3feeb5fa","year":2014},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.288779Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:67e9e75bb3fdf3dcea23a2e6ea4e1c4a2b984edddf7067cd2ed1b64d798104f4","observation_id":"b86e3a9c-34ca-4733-bee2-07d65d9ba4e2","resolution":{"observed_at":"2026-08-06T00:51:07.758370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:07.478664Z","title":null,"venue":null,"work_id":"59d9cb0c-18e7-49bb-80b7-063ca8ae12d9","year":2021},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.361958Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:8d8aa1e008c9af424d4789f18566b9af88c331823c9324ffe52961f509a5de0e","observation_id":"7cf5b814-9d85-4455-8425-7aae5e007699","resolution":{"observed_at":"2026-08-06T00:51:07.547278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:07.285199Z","title":null,"venue":null,"work_id":"c5f64b12-628a-41f6-a730-63922451a424","year":2024},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.488126Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:713bfa47f9ba3c9b8413c7a9fde8edc403d60b50bbc36830dc6232c7ad27e618","observation_id":"e4fa689b-8097-423e-9a04-d0dfc47a1b38","resolution":{"observed_at":"2026-08-06T00:51:07.390661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:07.083385Z","title":null,"venue":null,"work_id":"b28543ed-6567-4716-9409-36ae5914e846","year":2005},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.679128Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:aad34517b11fe3e0dd2ef69828bc6a886b00435b826b1d91cd8f4126e7aa06bd","observation_id":"1ed108c8-d033-475a-bd4c-1411bba96683","resolution":{"observed_at":"2026-08-06T00:51:07.183249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01774","last_updated":"2018-07-04T20:59:35Z","snapshot_observed_at":"2026-07-06T06:48:26.494005Z","submitted_at":"2018-07-04T20:59:35Z","title":"BOHB: Robust and Efficient Hyperparameter Optimization at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01774","snapshot_observed_at":"2026-08-06T00:50:58.895055Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:58.895055Z"},"links":{"cited_paper":"/paper/1807.01774","citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:1bdadec56bbe23e42e70b621bf6ea6bcc294a4cc4f123e3b25e340aaff6b6bb6","observation_id":"c2803b24-3ba9-400c-869c-8f3ce58ccab3","resolution":{"observed_at":"2026-08-06T00:50:58.895055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:06.879355Z","title":null,"venue":null,"work_id":"b70d3a44-4b4f-462b-adb8-2d04ba768d82","year":2019},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.003978Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:1111c513beb8f44ceae0953f63431fc4aef7d49af4482284332025466f41f9cf","observation_id":"cf85cc61-8d56-4b2f-aadc-23b96a871d31","resolution":{"observed_at":"2026-08-06T00:51:06.977921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:06.727826Z","title":null,"venue":null,"work_id":"d5d3b6c9-c9b5-4575-a4c3-8a26f6f94bb4","year":2017},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.103096Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:102f0e3c83b01e6e9be68618d5294a95f56030e8b9bf12bd5ef7da716b303ee5","observation_id":"3578aa82-a7a5-4004-af27-02176318c8f9","resolution":{"observed_at":"2026-08-06T00:51:06.800005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:06.584309Z","title":null,"venue":null,"work_id":"1f249831-d292-457f-ad88-e58b855b4f3e","year":2019},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.209147Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:5b9b36f98a436ca56009fc5efca1cc203cecb9794f431dca9dcd9d614903b84f","observation_id":"abd411da-7ba3-4b2b-a7d6-b757c41b7913","resolution":{"observed_at":"2026-08-06T00:51:06.649183Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:06.381819Z","title":null,"venue":null,"work_id":"764d44f0-6289-49c9-9a62-73c2cee94f4a","year":1952},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.318101Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:a946eb2f79c97f5b605dc04618ecff50bb74d6e22dfbabe68220474f66fee40b","observation_id":"3d64f952-a988-4b50-a530-e8ae40c63db9","resolution":{"observed_at":"2026-08-06T00:51:06.481150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:06.198089Z","title":null,"venue":null,"work_id":"d5d471fa-1a14-4b86-a283-42ca6347a731","year":2014},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.395151Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:df1b046e66a13ed0fd949201f4dc4e117375d10b6a68da0db0ae3a146a20a2d2","observation_id":"1327b2f8-fbdb-4d84-b3e9-f77dbd9bf132","resolution":{"observed_at":"2026-08-06T00:51:06.288672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:06.011580Z","title":null,"venue":null,"work_id":"b5a4c847-194d-46a6-b9ec-5500198d26be","year":2012},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.481823Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:a92a226f54b36527400585bbb88b4d3edb01bb2df17f3eeef09e34c51817f052","observation_id":"c694ce6b-b687-4a11-85f8-02c5b670bd24","resolution":{"observed_at":"2026-08-06T00:51:06.106188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:05.786232Z","title":null,"venue":null,"work_id":"115c1f92-6bb7-4959-b1e7-afad7f334f2a","year":2014},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.558021Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:8d32d963c35268fcabd49ca8d30686498f9e64517604035088cfc26f2075fcd6","observation_id":"66197517-8e34-4a03-9386-51cb8f29946a","resolution":{"observed_at":"2026-08-06T00:51:05.863667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:59.667025Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.667025Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:566e98d0ba68c03f04ecf515ecbd951a34891e5c8338c41a84b47ad268b599e8","observation_id":"0e35f6c7-82c2-4866-bfe3-9ff670cdfe19","resolution":{"observed_at":"2026-08-06T00:50:59.667025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:05.559896Z","title":null,"venue":null,"work_id":"de6e5bd7-b138-4709-aa66-58de7bf069cd","year":2017},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.770076Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:a779e137fc07b9eb3fd24c85a2cd6c94d9b52be5eed3af8e45eb7bf3c871caa3","observation_id":"61afd719-4613-4846-8f10-07db74a406b3","resolution":{"observed_at":"2026-08-06T00:51:05.684253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:59.851084Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.851084Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:fc905db3ae936dfcc6ec01d247a5005017a724316f4d9894c3463aaef187f3f6","observation_id":"aa6b52f1-61d7-43f0-a8c7-31202ee50fc1","resolution":{"observed_at":"2026-08-06T00:50:59.851084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:05.394743Z","title":null,"venue":null,"work_id":"5bdc3e71-8656-4d73-8527-73f143c8701c","year":1985},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:50:59.943977Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:5362a86452abbf8a45ad919327bb3c86b049cf5c7ee804c1acb74f05ad334ff6","observation_id":"e05363bf-a3ba-4f9a-84fc-fc1d190bfbd7","resolution":{"observed_at":"2026-08-06T00:51:05.424185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:05.227244Z","title":null,"venue":null,"work_id":"c35471ab-4128-4b94-a1d6-21be257650b5","year":2018},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.015984Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:dcb4faaacf4a3a230cfe3a6bb0c20f5e3c8bd6808e77ec99ef83d560b5a8bbbd","observation_id":"29c3cb89-3c1c-4df4-8b13-43dcb6aa5099","resolution":{"observed_at":"2026-08-06T00:51:05.304423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:05.098951Z","title":null,"venue":null,"work_id":"0463921c-1481-40f6-a3f8-1e236b6b4761","year":2022},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.094157Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:6152bc504ee5885d2b0b4d7b166845944c788e74eb5a0201f5c3f4075f08f576","observation_id":"3de59fbd-668c-4f59-98d2-50668d6b7647","resolution":{"observed_at":"2026-08-06T00:51:05.151697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:00.190610Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.190610Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:26bf5553a5bfb5e6cff3411dc415d11da54689dbe90351a6d85fc220c699c369","observation_id":"1b938deb-1c7d-40f4-bf56-04e47fa17175","resolution":{"observed_at":"2026-08-06T00:51:00.190610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.981210Z","title":null,"venue":null,"work_id":"088dcce6-9d3f-4da0-863d-dfe3d2765517","year":2018},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.299418Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:457ec9238cde1fe9ac5b8d3edc9b9b328cb570edfda17410c907e125b6f0385d","observation_id":"8741e1cf-023f-444a-b4d7-f439e02350db","resolution":{"observed_at":"2026-08-06T00:51:05.017298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.00105","last_updated":"2019-08-31T01:50:42Z","snapshot_observed_at":"2026-08-05T06:13:43.429046Z","submitted_at":"2019-08-31T01:50:42Z","title":"Generating Personalized Recipes from Historical User Preferences","version":1},"cited_work":{"arxiv_id":"1909.00105","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.00105","snapshot_observed_at":"2026-08-06T00:51:02.419381Z","title":"Generating Personalized Recipes from Historical User Preferences","venue":"cs.CL","work_id":"a5dc9b1f-6b46-4132-9527-7f1408f4c052","year":2019},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.374453Z"},"links":{"cited_paper":"/paper/1909.00105","citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:f1ecff3829b2647352a626b16d3302e28610b433f72aa8ba15f7fd98dc79c844","observation_id":"0df3b4f2-d7ba-444a-8255-e328c59f1f52","resolution":{"observed_at":"2026-08-06T00:51:02.536644Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.837301Z","title":null,"venue":null,"work_id":"a18c96bc-57f8-499c-9f8d-dd30f339e2c7","year":2015},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.482451Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:1d6f4a5356056540b12bed731c7b6cb6db8bce984016aa28821cb098c856f74a","observation_id":"2c44fbd2-1e4d-43da-8626-475fbadaaf6a","resolution":{"observed_at":"2026-08-06T00:51:04.917827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.706256Z","title":null,"venue":null,"work_id":"16771406-eb13-44fe-aa42-f4df9ab912e2","year":2020},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.585463Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:cc2b9d9299343f57c170bbc0c6b429af0e71b059836673cf6b49f2ead1da67ad","observation_id":"2fb45187-42c2-4983-8eda-717e56a0da6a","resolution":{"observed_at":"2026-08-06T00:51:04.754461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.545146Z","title":null,"venue":null,"work_id":"250dc1e4-82d0-4a54-a40c-90a7ee6ced87","year":2016},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.694181Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:4667f6e75553498a7e332b411f8016370b143d0e85426a4b7761dc276be75e3b","observation_id":"a8376eea-8e05-470a-9e3e-b908537f27a8","resolution":{"observed_at":"2026-08-06T00:51:04.617367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.437733Z","title":null,"venue":null,"work_id":"4e7ecb63-cb33-4298-a004-88f5ca8a3eac","year":2008},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.763509Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:b8b2e0b8a678fffc28e52065172f5c53043d466350fe0ba58f2b86fd5e971d52","observation_id":"d4392279-21f4-4cc8-84f4-11a60b4819da","resolution":{"observed_at":"2026-08-06T00:51:04.479694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07382","last_updated":"2024-12-10T10:28:32Z","snapshot_observed_at":"2026-07-06T20:04:34.632244Z","submitted_at":"2024-12-10T10:28:32Z","title":"Temporal Linear Item-Item Model for Sequential Recommendation","version":1},"cited_work":{"arxiv_id":"2412.07382","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07382","snapshot_observed_at":"2026-08-06T00:51:02.266260Z","title":"Temporal Linear Item-Item Model for Sequential Recommendation","venue":"cs.IR","work_id":"1d1019aa-31a8-47e0-a336-d7c2bf951b59","year":2024},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.870038Z"},"links":{"cited_paper":"/paper/2412.07382","citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:4b219895af46207ac69d87d3ffdf7ebcdb2f9caf8ed9e8b96d82dae0f4d93cbb","observation_id":"1fc0493d-dedf-4a0e-b678-93f9432a9387","resolution":{"observed_at":"2026-08-06T00:51:02.350844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08393","last_updated":"2025-04-14T14:55:02Z","snapshot_observed_at":"2026-07-06T20:50:37.862550Z","submitted_at":"2025-03-11T12:57:24Z","title":"Weighted Tensor Decompositions for Context-aware Collaborative Filtering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08393","snapshot_observed_at":"2026-08-06T00:51:00.966734Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:00.966734Z"},"links":{"cited_paper":"/paper/2503.08393","citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:bc52f88f35a21d03486f7e7b86c7f60d0d836e2d5d5866dab70052e35b69157b","observation_id":"ee696e21-a74b-4d43-8234-6211d9ba3bcb","resolution":{"observed_at":"2026-08-06T00:51:00.966734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.325709Z","title":null,"venue":null,"work_id":"5f2e72f1-2eee-4b85-98fe-f543cb787586","year":2020},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.077284Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:3c8e159e8c1e3d7fc814f9b3ab4f24a7ac3a3e5c33765a97d5efb2fe7f614db3","observation_id":"d2fe83ac-824b-44a4-86fe-9f7fdfa5303b","resolution":{"observed_at":"2026-08-06T00:51:04.379663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.195779Z","title":null,"venue":null,"work_id":"4dec4972-ce11-4a85-8be4-81a7496edb87","year":2015},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.140476Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:c169105106093c935616a316a64a5e58900b49b840472d87459e553e457de105","observation_id":"ba745c4e-4489-418a-9bd7-8ebcd002d1b0","resolution":{"observed_at":"2026-08-06T00:51:04.260476Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:04.032525Z","title":null,"venue":null,"work_id":"62ea0fbf-c721-4a38-9ad4-327fb1eccd17","year":2022},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.217255Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:a10df3f2e02ae767d7717ccce6efd73cb3b1bba0c0526d9e42b9df75a0b04192","observation_id":"c8589955-a23a-4d4d-b4cc-762348820b03","resolution":{"observed_at":"2026-08-06T00:51:04.112971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.13033","last_updated":"2019-04-30T03:21:19Z","snapshot_observed_at":"2026-07-06T07:49:25.100741Z","submitted_at":"2019-04-30T03:21:19Z","title":"Collaborative Filtering via High-Dimensional Regression","version":1},"cited_work":{"arxiv_id":"1904.13033","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.13033","snapshot_observed_at":"2026-08-06T00:51:02.112980Z","title":"Collaborative Filtering via High-Dimensional Regression","venue":"cs.IR","work_id":"2051840c-3467-4c5c-bb4d-e1cf833f943f","year":2019},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.313331Z"},"links":{"cited_paper":"/paper/1904.13033","citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:72254ce8ce82344667aad09c11f0a733fdebef68d8aba87d35c63e92505fdf80","observation_id":"54a6b432-50ec-49cf-bcb6-1317fc0081a0","resolution":{"observed_at":"2026-08-06T00:51:02.159177Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:03.898306Z","title":null,"venue":null,"work_id":"eb1094d9-242c-4e1d-97a9-e665703d08ac","year":2019},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.430092Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:c73ed9a36be404cf4777f8ed2134b00fe2e02dcccb7257c6494858d88a8172bd","observation_id":"5ce1d01b-3dab-4a41-9e3f-ab2a0bb54fe7","resolution":{"observed_at":"2026-08-06T00:51:03.951266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:03.734421Z","title":null,"venue":null,"work_id":"ab77b30c-3a66-48e7-9d50-809f6d264fc4","year":2017},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.523728Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:73000eec9fd07443a73be4944b2701b0fd596e16db38c9c053be979e89a5ddf6","observation_id":"8a8634f9-eee8-49da-bdbf-a8553ca2d2b8","resolution":{"observed_at":"2026-08-06T00:51:03.814928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:03.578085Z","title":null,"venue":null,"work_id":"196cb63f-f752-45a1-bc69-4bf801c15d78","year":2022},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.596980Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:cd9a156c12d7d166f6772837a4dd738b3b694035a50522219fd666db43575a08","observation_id":"c4adc4ad-480b-45b6-a594-ba9913413d27","resolution":{"observed_at":"2026-08-06T00:51:03.655565Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:03.473654Z","title":null,"venue":null,"work_id":"cea0f0ae-0bd7-4526-a26b-00e450bdf9ae","year":2015},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.706095Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:42eeee24ceb994ced2f64947da39949b729a6168091e2c03b8a25aca8af65207","observation_id":"0d86dc23-fe8a-4dec-9923-f0d4bd0849d2","resolution":{"observed_at":"2026-08-06T00:51:03.520594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:01.784028Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.784028Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:9cbb64cffd8a69857d528fa9c9333da45d336190721a9f8bd66c0639b52898d3","observation_id":"7dc0c0f8-b7a2-4a50-b363-c8a78264ded4","resolution":{"observed_at":"2026-08-06T00:51:01.784028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:03.354547Z","title":null,"venue":null,"work_id":"06d0276f-d653-471f-baa8-6214bdd24413","year":2022},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.870215Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:c23eef3b738e03cc8d6eb7de7bf5c22344f5e4a4801cd8aeff32f1366c521c8f","observation_id":"1526ffdb-a8e7-4e5c-92f9-f385650d831f","resolution":{"observed_at":"2026-08-06T00:51:03.414069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:03.188574Z","title":null,"venue":null,"work_id":"0b21ddc7-d167-4d37-a207-0ea7cae41ccd","year":2002},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:01.939046Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:d9454fef3a2f11f96790e716e0b40681c76c6ddb450889468ca9cc6f2d9dbfe0","observation_id":"cc466f6f-cb9b-4fad-b3d8-bd202a72e801","resolution":{"observed_at":"2026-08-06T00:51:03.267263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:03.053542Z","title":null,"venue":null,"work_id":"141a7f02-ac8b-402b-b994-01510321a2c2","year":2015},"citing_paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:02.003627Z"},"links":{"citing_paper":"/paper/2508.04225"},"observation_digest":"sha256:c8034928076b6c728fcb0ddce26b5838800b740f07281ee87b4454190a4f1108","observation_id":"33f8e5f7-87c1-485d-a25c-0f4fad3d0fdd","resolution":{"observed_at":"2026-08-06T00:51:03.116185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.04225","last_updated":"2026-07-18T00:42:02Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T00:50:54.863546Z","submitted_at":"2025-08-06T09:01:29Z","title":"Symmetric Behavior Regularized Policy Optimization"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":40,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2508.04225."}