{"as_of":"2026-08-13T11:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5687888e555ddb4bd81aa122134fd36ec4066d8ded24f227e0d1b8a605621c74","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:49:22.597415Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15891/citation-record","integrity":"/paper/2411.15891/integrity","json":"/paper/2411.15891/citation-record.json","paper":"/paper/2411.15891"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.403485Z","title":"Constrained Markov decision processes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.403485Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:8fc7036670f822087004b44388f9827875b606bdfc68c5b26f7930688212530b","observation_id":"e5730b2e-a828-47f9-9db7-50efc51751c9","resolution":{"observed_at":"2026-08-12T13:49:22.403485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.093316Z","title":"Routledge, 2013","venue":null,"work_id":"e1517d5a-fb89-4aa5-8e5a-a974eb29beb7","year":2013},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.406267Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:b9eab79172bb63eb9db544e18c2edc21dfdf1fc9aa0c8ea7b01f1c19d86bad61","observation_id":"12300fe1-1be6-40ad-bd72-40d9bbc8c343","resolution":{"observed_at":"2026-08-12T13:49:23.095642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.086713Z","title":"Reward, motivation, and reinforcement learning","venue":null,"work_id":"9c5e873c-309f-45e3-93f3-bd892931c8af","year":2002},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.409277Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ba25c7ec6808fe7277bcf95e488609840e999c6044dcc0862a1efb1bf5db7e8f","observation_id":"8a77f1bf-fc4b-4949-9143-1e0469e68530","resolution":{"observed_at":"2026-08-12T13:49:23.089131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10936","last_updated":"2022-07-16T01:27:59Z","snapshot_observed_at":"2026-07-06T12:40:27.042790Z","submitted_at":"2022-02-18T15:15:46Z","title":"A Survey of Vision-Language Pre-Trained Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10936","snapshot_observed_at":"2026-08-12T13:49:22.411985Z","title":"A survey of vision-language pre-trained models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.411985Z"},"links":{"cited_paper":"/paper/2202.10936","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:47232e7b99f823e104fb375e98c13bb0bf5749465caa1676f36f08d9bc6bee50","observation_id":"fe8d358f-6622-41e2-b030-a2414705ac9f","resolution":{"observed_at":"2026-08-12T13:49:22.411985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.414852Z","title":"Guiding pretraining in reinforcement learning with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.414852Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:a7d2ae7a246cad7817465143562150e283d31033f982a11437fd8abe4b7d9023","observation_id":"4de2b189-1c2e-4e41-86c5-025e47a03736","resolution":{"observed_at":"2026-08-12T13:49:22.414852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-07-06T07:49:17.886466Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-12T13:49:22.417608Z","title":"Challenges of real-world reinforce- ment learning","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.417608Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:a15616f226e7d3710b29c03b7caa93bd1c1bafadeaca4d52a42366d46fd63a94","observation_id":"16a60ee7-862c-4707-835e-dee2b3826ad0","resolution":{"observed_at":"2026-08-12T13:49:22.417608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.422248Z","title":"Minedojo: Building open-ended embodied agents with internet-scale knowledge","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.422248Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:7635a24fdb02225530a60732bfbb9499b2c7fc05f1a927aa31c037490a4fa103","observation_id":"3409a428-f6ae-4849-ab2d-9f4df05da5d4","resolution":{"observed_at":"2026-08-12T13:49:22.422248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.425200Z","title":"Policy shaping: Integrating human feedback with reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.425200Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:17adcaf9912ce61c2ace1e5e1d40850c10af33b807b62b801aa5cc692037d538","observation_id":"d037a2e5-923a-4859-88e1-d7251c096643","resolution":{"observed_at":"2026-08-12T13:49:22.425200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06780","last_updated":"2022-02-12T20:02:13Z","snapshot_observed_at":"2026-08-08T06:33:33.529614Z","submitted_at":"2021-09-14T15:49:31Z","title":"Benchmarking the Spectrum of Agent Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.06780","snapshot_observed_at":"2026-08-12T13:49:22.428266Z","title":"Benchmarking the spectrum of agent capabilities","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.428266Z"},"links":{"cited_paper":"/paper/2109.06780","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:045d4366c6277c976e575fef8f6ab8a6a307aa6e981aef43bf7e819dd16ff961","observation_id":"e0c32622-99b0-4e7f-a7e5-24d5a1210185","resolution":{"observed_at":"2026-08-12T13:49:22.428266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.066834Z","title":"Using reward machines for high-level task specification and decomposition in reinforcement learning","venue":null,"work_id":"121d94b6-86f9-44e3-b900-726cf5b26965","year":2018},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.431464Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:7a5eda70105f80d078ff1ae429a7d166cf9830223d88244179774338eafaa420","observation_id":"7249f65d-f425-41c1-9887-bbb3f57e0980","resolution":{"observed_at":"2026-08-12T13:49:23.069945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.434197Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.434197Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ce713e8db9c35aee4b6f1dccc50b49e6190f0102471af6707148c73873f04717","observation_id":"f91fc658-83e0-4206-95f5-6305ac82f773","resolution":{"observed_at":"2026-08-12T13:49:22.434197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00001","last_updated":"2023-02-27T22:09:35Z","snapshot_observed_at":"2026-08-11T16:00:06.021847Z","submitted_at":"2023-02-27T22:09:35Z","title":"Reward Design with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00001","snapshot_observed_at":"2026-08-12T13:49:22.437321Z","title":"Reward design with language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.437321Z"},"links":{"cited_paper":"/paper/2303.00001","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:6542bba9066b9bcc3a93bcf15ca1ba7216b74a4a6ff9592f702b1edd350fdc2b","observation_id":"e52a120c-1d04-4860-9bba-02ba5df35fda","resolution":{"observed_at":"2026-08-12T13:49:22.437321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07274","last_updated":"2018-11-26T04:56:31Z","snapshot_observed_at":"2026-08-13T10:40:41.947431Z","submitted_at":"2017-01-25T11:52:11Z","title":"Deep Reinforcement Learning: An Overview","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07274","snapshot_observed_at":"2026-08-12T13:49:22.440447Z","title":"Deep reinforcement learning: An overview","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.440447Z"},"links":{"cited_paper":"/paper/1701.07274","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:51405eec5c7d8ff2c9aab005890ec6b888c9ab55bd6ea8381592f132ec22eb7a","observation_id":"b4b6bb14-1776-43a9-af9c-09b861b19979","resolution":{"observed_at":"2026-08-12T13:49:22.440447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-12T13:49:22.443566Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.443566Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:c67401f37c9e580fe491a697f2c48a1e761b53929a5a00b11662989d5de34b09","observation_id":"936a3f44-63da-45ab-8f05-074f56abeed3","resolution":{"observed_at":"2026-08-12T13:49:22.443566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-08-12T13:49:22.446439Z","title":"Eureka: Human-level reward design via coding large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.446439Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:e9d1f3218acbb2aca0ea179a24f767ab64afda6f68402bb547c3fd75d42d9031","observation_id":"06679766-064e-43be-99eb-09c151dedb3f","resolution":{"observed_at":"2026-08-12T13:49:22.446439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.449596Z","title":"Policy invariance under reward transfor- mations: Theory and application to reward shaping","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.449596Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:70c91eb450c0a71681fc1407b489d5596d352acac8164b037e245830da4ee447","observation_id":"c36864a1-fc4f-445c-8588-33f21e9b297c","resolution":{"observed_at":"2026-08-12T13:49:22.449596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.451642Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.451642Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:e126336a50df4050417063287387a43bf92103485397a7e2bd74799140e75e1b","observation_id":"7d38c55d-13b2-406e-8a4e-8be5b3cbafaa","resolution":{"observed_at":"2026-08-12T13:49:22.451642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T13:49:22.454044Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.454044Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ff99ffb1c50fa7e5fb6d670f3cc7272be89ebb8853e81a028099e1257941520f","observation_id":"f27520aa-6c16-492c-bb19-499631754dc9","resolution":{"observed_at":"2026-08-12T13:49:22.454044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.047161Z","title":"Common-sense and scientific interpretation of human action","venue":null,"work_id":"a19bb101-8bd6-499b-ba8b-dec05964d172","year":1962},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.456610Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:9015f9d56f4daf890d77c71dee6372d2411a631c6142ae06d0b02720ec5e8dd9","observation_id":"ce3d7bed-052d-4a40-8067-94b8f74de25c","resolution":{"observed_at":"2026-08-12T13:49:23.050911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.459217Z","title":"Defining and characterizing reward gaming","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.459217Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:b672ac32b3995959431230d317f758e0acfb0c378936a082271b6e38b4d8109d","observation_id":"264f7a10-4f8d-44d6-95b7-44060dedf42a","resolution":{"observed_at":"2026-08-12T13:49:22.459217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.461520Z","title":"Adaplanner: Adaptive planning from feedback with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.461520Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:329914bc8e855812e4b7aa1e9327e4ee22b19e67da289b58287ab32d6724881f","observation_id":"e28a564e-f73d-4722-837f-ed08c3bcc499","resolution":{"observed_at":"2026-08-12T13:49:22.461520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-11T16:01:36.938012Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-12T13:49:22.464096Z","title":"V oyager: An open-ended embodied agent with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.464096Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:826a28b5d3e122822faebc9849c14ec30699c093779cc2348724bc133a9cae3a","observation_id":"8df67df2-7f27-4c70-9d24-1e2a7b942df1","resolution":{"observed_at":"2026-08-12T13:49:22.464096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01444","last_updated":"2024-04-14T03:47:19Z","snapshot_observed_at":"2026-08-13T06:00:00.414735Z","submitted_at":"2023-10-01T07:50:30Z","title":"Adapting LLM Agents with Universal Feedback in Communication","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01444","snapshot_observed_at":"2026-08-12T13:49:22.466971Z","title":"Adapting llm agents through communication","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.466971Z"},"links":{"cited_paper":"/paper/2310.01444","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:951b423e0745c842932755459142a74f26d9d2237a18cb32d3cffe882e0dde6c","observation_id":"67912c35-e889-4121-a4da-9fae28b5ad30","resolution":{"observed_at":"2026-08-12T13:49:22.466971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.032709Z","title":"Read and reap the rewards: Learning to play atari with the help of instruction manuals","venue":null,"work_id":"71c7e59c-69a7-4c39-97a1-b19b15a9099c","year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.469441Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0079b9d9abb637ef6a964d1b365bf5b33b8a51957eda23c7f2fd0d0ce5f51514","observation_id":"f3ceab26-fdc6-43c5-b71d-a11be1351dd8","resolution":{"observed_at":"2026-08-12T13:49:23.035442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.025624Z","title":"Spring: Studying papers and reasoning to play games","venue":null,"work_id":"0043e012-de3b-4f79-a116-81b59a6e8863","year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.472050Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:efec5f6d8166b58745c9749eb29d769f7bc5feb505dc4ad948fb7b0e9a858bad","observation_id":"1af16bc7-5f2b-4aa0-b907-dcc65a32a5ca","resolution":{"observed_at":"2026-08-12T13:49:23.028424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-09T18:54:02.679174Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-12T13:49:22.475284Z","title":"The rise and potential of large language model based agents: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.475284Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:de509bbd0bcb17b2c7e782dca49975c2bcebf2a8b8e1e1689b9cdecface5f2a2","observation_id":"13a21f45-de4b-420e-a84c-c2dadda6046d","resolution":{"observed_at":"2026-08-12T13:49:22.475284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.018306Z","title":"Language models meet world models: Embodied experiences enhance language models","venue":null,"work_id":"18fe945c-0c59-481f-9f59-eb8fa026176c","year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.479025Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:957f2bfff909a81d9fea68c358bab8f4b8efdcbbdbd8acc522576fe1478fd53c","observation_id":"4b27f341-6dba-45e7-bff7-c4c47ed1846c","resolution":{"observed_at":"2026-08-12T13:49:23.021347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11489","last_updated":"2024-05-25T06:42:10Z","snapshot_observed_at":"2026-08-13T10:09:02.912910Z","submitted_at":"2023-09-20T17:39:13Z","title":"Text2Reward: Reward Shaping with Language Models for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11489","snapshot_observed_at":"2026-08-12T13:49:22.482971Z","title":"Text2reward: Automated dense reward function generation for reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.482971Z"},"links":{"cited_paper":"/paper/2309.11489","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:aa01945ca2f3e6052b62a509e11d856988e8087b7480b24ab280e5876349cf77","observation_id":"e10fc02c-5a48-4546-9eb0-6ef2a4909a80","resolution":{"observed_at":"2026-08-12T13:49:22.482971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01711","last_updated":"2024-02-15T02:57:22Z","snapshot_observed_at":"2026-08-13T11:25:32.403659Z","submitted_at":"2023-06-02T17:32:17Z","title":"OMNI: Open-endedness via Models of human Notions of Interestingness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01711","snapshot_observed_at":"2026-08-12T13:49:22.485844Z","title":"Omni: Open-endedness via models of human notions of interestingness","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.485844Z"},"links":{"cited_paper":"/paper/2306.01711","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:5817ea163f3506424defcd2030122c0bfd4b93cac37171eb83677edd1e35caa3","observation_id":"5ea22727-e5cb-4801-964e-7cb077289ecc","resolution":{"observed_at":"2026-08-12T13:49:22.485844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17144","last_updated":"2023-06-01T09:18:01Z","snapshot_observed_at":"2026-07-06T15:34:05.442952Z","submitted_at":"2023-05-25T17:59:49Z","title":"Ghost in the Minecraft: Generally Capable Agents for Open-World Environments via Large Language Models with Text-based Knowledge and Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17144","snapshot_observed_at":"2026-08-12T13:49:22.488729Z","title":"do\" (which means","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.488729Z"},"links":{"cited_paper":"/paper/2305.17144","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:85cd02677cf4213b021e5c357c1132a315f1a4639ecbede95f08465e18aac0fa","observation_id":"efa46d08-1148-460f-9781-6f35a2d6a8a4","resolution":{"observed_at":"2026-08-12T13:49:22.488729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.010886Z","title":null,"venue":null,"work_id":"efe87ae7-4834-4471-a8b0-d3a0c87c7810","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.491989Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:653694ae26db489136c405407bc039d614a240e3f8be4a9223cda4ee4668dacc","observation_id":"4a74a080-8481-4c52-82ff-6f8a93feb884","resolution":{"observed_at":"2026-08-12T13:49:23.012959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.004657Z","title":null,"venue":null,"work_id":"979f9b8b-53b9-4b54-993a-6263562a3b97","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.494749Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:54d2f41f2e842dae98c37367b28e137455cbe27179a5ee80a0366ca4a1e36647","observation_id":"46a8fe70-3469-4916-90d0-81478148b121","resolution":{"observed_at":"2026-08-12T13:49:23.007094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.998055Z","title":null,"venue":null,"work_id":"46154cda-7ffe-4e92-83d4-54a0fd62338f","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.497747Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:24e3d03f1b6f19612cc7752729bdd1de7e26d1aa448b0a049586f8aa0c64b36f","observation_id":"7b929018-5046-4546-b087-aa7c99c0b3f6","resolution":{"observed_at":"2026-08-12T13:49:23.000850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.992069Z","title":null,"venue":null,"work_id":"7322970b-1d82-465a-bb4b-6a0381ab4bed","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.500397Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:8952b2bd04936bc30c29106460e84396bc7b8486fc03970158d8b16d77c64fad","observation_id":"e621dc82-1499-403e-9df5-4014b9563a5a","resolution":{"observed_at":"2026-08-12T13:49:22.994241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.986231Z","title":null,"venue":null,"work_id":"7c3a40d7-b746-4989-a1db-5696099754c7","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.503135Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:a5a5c5bcef710b42d485cb054e09cae11b81841d69922a268fc3ad3a6dcea191","observation_id":"6d685bb7-6749-4618-84e8-8eb7bd3161b2","resolution":{"observed_at":"2026-08-12T13:49:22.988326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.979917Z","title":null,"venue":null,"work_id":"40b08367-6202-4ff5-bf14-7cbb12e3157a","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.505707Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0d0ab626eb8778ad562a5e221027d3e7870c357b4534bfea644152452bb7e5a0","observation_id":"66474603-aa76-4732-a49b-5a0f34c193e7","resolution":{"observed_at":"2026-08-12T13:49:22.982408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.972931Z","title":null,"venue":null,"work_id":"694ad2ef-8933-43b6-9897-7f5cdb30d461","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.508195Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:9dab35f3cbc500725efd4adf3498163865ce5beca9dd8abd5328c754e4f0ce19","observation_id":"d9a7c310-31e7-48f7-9b94-ddd5cc33ef07","resolution":{"observed_at":"2026-08-12T13:49:22.975598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.966212Z","title":null,"venue":null,"work_id":"2467f3a2-02e3-4d51-8773-946c9aa001c2","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.510429Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0636088390594d02837f4df557ffa165adacfa3f28dccadc51cf3c061bac117c","observation_id":"3fe177cc-efbc-44ba-8641-11f028878161","resolution":{"observed_at":"2026-08-12T13:49:22.968782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.959493Z","title":null,"venue":null,"work_id":"a64a7d6f-1f3a-42ef-bb0f-2de92684493b","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.512541Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:c4b22f24ec3494db2cde300cd89ff55be033835a54226dec1e2d1d03117f8f42","observation_id":"41c1f031-09b0-43be-aba5-18972c6e6f80","resolution":{"observed_at":"2026-08-12T13:49:22.962060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.952697Z","title":null,"venue":null,"work_id":"08e849f9-3b3a-495d-baf9-91942229fbaa","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.514506Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:085ca342de106fc12212945c503828edb32d6535bff5676ef79fca7ac367f1e7","observation_id":"3b50d6bb-ab1e-4b4b-ae2f-f1e391e5fd38","resolution":{"observed_at":"2026-08-12T13:49:22.955190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.945992Z","title":null,"venue":null,"work_id":"44de65b1-4533-4dcf-ad6e-99871d8091a4","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.516639Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:c8e6f2665c3bbf23dc85485c03f43c32e3fe84135acdb9d4140a62f7a79c640f","observation_id":"fde7b0de-3a64-4066-a508-30610fab0051","resolution":{"observed_at":"2026-08-12T13:49:22.948571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.939709Z","title":null,"venue":null,"work_id":"356e2912-7ee5-4766-9b73-1b339f5ef27d","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.519215Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:1565a64e1eda58cacf190f90d069acae6b039bac03e82f9fd940a8531fb8018e","observation_id":"00e9ad08-24d0-4348-8a51-8fe3b303c352","resolution":{"observed_at":"2026-08-12T13:49:22.942247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.933860Z","title":null,"venue":null,"work_id":"eb95ee86-afc5-4097-b0c6-ca07a271d59d","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.521211Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:b4c36acdfc2cb99afd641601cfc61590528e94fa1cb8f36d2aaeddd87db66100","observation_id":"83dbc9e3-3687-4fe2-8559-7c95b456ca8b","resolution":{"observed_at":"2026-08-12T13:49:22.935943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.927896Z","title":null,"venue":null,"work_id":"1e40161a-a242-4d01-8ab4-9720ec3b0e4f","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.523280Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:4c6976b9635ee8bdce39aed8b5759703bca16f63ff886dbe3e6731f30fe2b15d","observation_id":"bebd3f05-7696-4be3-98cb-e1761a8ffe6a","resolution":{"observed_at":"2026-08-12T13:49:22.930201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.921571Z","title":null,"venue":null,"work_id":"b6081ce0-e381-4071-a77f-efe7b45e8848","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.525420Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:122f4438f5dbecdbe0a865a19f0d29d6c57c1cf97e9566f9c2504f88a36faac8","observation_id":"ea5ee6bc-b48d-4bc2-aa8a-b9bd9933e8e1","resolution":{"observed_at":"2026-08-12T13:49:22.923861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.915875Z","title":"sleeping","venue":null,"work_id":"559db1da-e3b0-4ee0-8cc4-e19d22b2181d","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.527692Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:d6f12858d5d676bba011ee41be03619cec733922ae9884ef3900b50516704567","observation_id":"d4f4f4de-532b-4e11-beb4-92af02666f2b","resolution":{"observed_at":"2026-08-12T13:49:22.917802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.909066Z","title":null,"venue":null,"work_id":"86b63856-5c9c-4916-845e-2bc0f035aa67","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.530172Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:44eaae14876e13d6485c70754bab64509bcfc5bd9cd54d101236a5c3b400dc45","observation_id":"45878069-6aeb-412c-b3db-74664c42074b","resolution":{"observed_at":"2026-08-12T13:49:22.911742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.901779Z","title":null,"venue":null,"work_id":"8406aa99-2c26-4595-a4ea-06eee9799179","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.533371Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:c525ff57cb80ca6e9756980e960e76b39cc4cfeacdd7256482233735efbdf53d","observation_id":"6cc88eea-2c4c-4a40-b288-702100e5d486","resolution":{"observed_at":"2026-08-12T13:49:22.904332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.892637Z","title":"Successfully collected iron from the grid directly to the right of the player, converting it from an iron() to path(), without affecting other attributes or nearby grids","venue":null,"work_id":"142ede76-5b14-4373-b40f-7f14ca08226b","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.535817Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:6e60ef366a47f3a6ed11b2188e75d12f7f4862e7c8be26d0ad0082474c71430b","observation_id":"200f1df5-ddd4-430d-bc27-a8a99db98d7b","resolution":{"observed_at":"2026-08-12T13:49:22.896847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.884768Z","title":null,"venue":null,"work_id":"73e26dd9-382e-4b84-bbd1-b2b0de0bf6bc","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.538590Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:c87bbe5dd34fe324b822f38664a5503c19565115aaedaeaa366b3df6aa26320d","observation_id":"f9966044-20dc-4c3f-af9d-aaaa34cd449f","resolution":{"observed_at":"2026-08-12T13:49:22.888405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.877286Z","title":null,"venue":null,"work_id":"c6e73a80-fbbd-41c8-843d-539ac132a9e6","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.541641Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:e994171133eff2d108d5b6f44b9cee5dbe04f0892f0c172ef5ee09da61e0d2cd","observation_id":"6b64fc6c-d066-4048-97cd-b2cce6abe3be","resolution":{"observed_at":"2026-08-12T13:49:22.879821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.871810Z","title":null,"venue":null,"work_id":"2a491f1b-7412-468c-813c-2a056d80e984","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.544952Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:94d43e3d4f6b8ed67e7e560128fb52cc759aa6161e1f9704aa463e68e8a90fd1","observation_id":"2f633399-fdb2-4d51-87d3-ec9d321080ae","resolution":{"observed_at":"2026-08-12T13:49:22.873705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.865905Z","title":null,"venue":null,"work_id":"bd52a326-29ec-4e63-9d8a-e884d0948bde","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.547816Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:bc9b57ac4b7cdad5e4af2b161c8046dd9f56a478da7c25afde5ab99bbaf9d7a0","observation_id":"b4391285-1389-4f95-b3fe-0280b6d1a2c7","resolution":{"observed_at":"2026-08-12T13:49:22.867973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.860156Z","title":null,"venue":null,"work_id":"9511f1b8-a432-4c7c-ad1c-13f1344b473f","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.550982Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:819614e7db06f50fbae7e98c1338064f9b643099d29dc5c9a41ca0df13c170f9","observation_id":"347fa5f9-e611-494b-a1df-64d30fd70e28","resolution":{"observed_at":"2026-08-12T13:49:22.862268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.854279Z","title":null,"venue":null,"work_id":"e3a72a60-fc24-49ff-9a32-0123194f7644","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.554156Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:8d6cab556b372e9677e4e8c06376504e1a86e52332fdd826e0c38034b1219756","observation_id":"e4618e09-9713-4090-b117-68114f72c6cb","resolution":{"observed_at":"2026-08-12T13:49:22.856390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.848330Z","title":null,"venue":null,"work_id":"f950bb0f-727c-4c42-9743-22d3faf57024","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.556895Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:35dbae9868b9173c3c9f1e5557991c3c9f07cf1550e19784ad03f37aebbdbe41","observation_id":"508d8b72-78b6-41ea-8b47-240babd5e45b","resolution":{"observed_at":"2026-08-12T13:49:22.850370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.841524Z","title":null,"venue":null,"work_id":"d1f52902-5b07-4244-8add-75f6a936df68","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.559870Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:26b829a4c40a04e996ba8dcbd64ac424975261d3cf8c7406f799f5900ea25524","observation_id":"641a49b5-e437-4936-98cf-bf6262ee6027","resolution":{"observed_at":"2026-08-12T13:49:22.844113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.834403Z","title":null,"venue":null,"work_id":"b3a4e65f-8a04-4ff4-a325-74fe560c7c71","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.562918Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ee25d96541ab7fc8cb5084bfe2ff7720e3bf52ccd19dad2c1227fe1b56ca9fde","observation_id":"282bf817-c163-4a6a-846d-b49d62b415e2","resolution":{"observed_at":"2026-08-12T13:49:22.836898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.826625Z","title":null,"venue":null,"work_id":"2fc87a26-76b7-4ce3-9516-c42912680ea5","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.565932Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ffcb344c6d6bd88088cc840425ad20b0b07345168122e6bed243a4f84b694be8","observation_id":"f3eb0622-46cf-4bb7-b3d6-0cb8a6326d3a","resolution":{"observed_at":"2026-08-12T13:49:22.829329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.817038Z","title":null,"venue":null,"work_id":"6fa5752d-1cab-48a5-afff-54475512866e","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.568968Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:865ccefdff35e44c694c1c270c0baa388bc775d48e738ba2cc3ae0f570520025","observation_id":"b3f48125-48b6-43ed-9f82-9820ae7e0372","resolution":{"observed_at":"2026-08-12T13:49:22.820455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.808718Z","title":null,"venue":null,"work_id":"1b07b3d7-510c-4a5c-a981-cddc304eff2c","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.571729Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0096619d48f2b6f159ab24d7014a0e3cea34719976dec06d8ac2505382e85a47","observation_id":"52098a18-0407-4a57-b008-b4c58db2395c","resolution":{"observed_at":"2026-08-12T13:49:22.811591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.800228Z","title":null,"venue":null,"work_id":"06b00a13-981d-41bf-953a-9e62b45a5ccb","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.574013Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:fe3cf93f1f045518b7fcda2299f77ab8445eb8e1e575a3c4c6d5abfa369fdb28","observation_id":"e0921cda-c1f5-432e-b86a-be8f930aedc6","resolution":{"observed_at":"2026-08-12T13:49:22.802846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.792555Z","title":null,"venue":null,"work_id":"2afca51e-d6f0-4981-8989-c3e0d898ea1a","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.575885Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:1b0382904b5aa9344d08f52591645877eb6bc70d5bac26c4119890cea4be3da9","observation_id":"bd99934c-0bef-4d82-88fb-052bc0b489cd","resolution":{"observed_at":"2026-08-12T13:49:22.795132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.785699Z","title":null,"venue":null,"work_id":"5461a7d9-5534-47c0-827c-05a3a9dccbf1","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.577954Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:84a6a40959aec26f76ed97d797ea03bd1cda1345d823d4ceebb3ea67234f6a5a","observation_id":"e31ce025-e848-48d6-92c3-c051183bf464","resolution":{"observed_at":"2026-08-12T13:49:22.787992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.778655Z","title":null,"venue":null,"work_id":"6c132e1b-f8f6-4486-935c-c523b79c3ae2","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.579829Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:3ebd5099ce93872a5d440682ac6d0c333246c8062e2064e662905847581a2c76","observation_id":"90dab58b-7474-4a12-802a-47ba440a0ac5","resolution":{"observed_at":"2026-08-12T13:49:22.780964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.769846Z","title":null,"venue":null,"work_id":"7b00dbc3-0522-4e35-b71c-fd4722b55226","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.581989Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:c5682f19f572acd644af88e9c2544e01ef9041e467ce77cec9c4b61b9271a5ef","observation_id":"6bb94166-6052-4d3f-a10f-4fcf1115e681","resolution":{"observed_at":"2026-08-12T13:49:22.773772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.762626Z","title":null,"venue":null,"work_id":"57a0283d-a91a-4ed4-a51b-bb682e1f82a0","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.583906Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:66f2c024ad8fb6e03aa7bd428edc5bf31b7d8c65e0b15344381521817afe55c2","observation_id":"d37fd1cd-cf5d-4132-ae7a-26a3f7f9c666","resolution":{"observed_at":"2026-08-12T13:49:22.765203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.754381Z","title":null,"venue":null,"work_id":"2c37cda8-d4a4-4668-84eb-9fbccfda004a","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.585940Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:28abe900128241397a24c851a6b67cbcb75d4704808e76596a91ee189ad8ccb5","observation_id":"954c261e-7907-4cb0-9b76-65439a5224f4","resolution":{"observed_at":"2026-08-12T13:49:22.757858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.746194Z","title":null,"venue":null,"work_id":"5655c2a3-455a-4495-8926-aa65dcf85244","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.587707Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:43bafad6e66944b3225cbbcfe215a79c02e124576cf9c31e5d9a77b71e729447","observation_id":"2d74857a-7325-4476-8f28-ba68a212a0ec","resolution":{"observed_at":"2026-08-12T13:49:22.748655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.737788Z","title":null,"venue":null,"work_id":"bc998c6e-af1e-474d-8bc9-d8d4beda330c","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.589584Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:32a1e645443c818e7f294c90ccf9c6184f6beee32916a2a00f03b1f34a574610","observation_id":"c467ebd5-cbd9-487b-a035-2a2dc58c5679","resolution":{"observed_at":"2026-08-12T13:49:22.740583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.731225Z","title":null,"venue":null,"work_id":"a1feefe7-b9bf-435d-b470-7959958f4a26","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.591330Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:8b429861f22e85767d8266d30983bda4e21854187334d9c16aa65b61e0aeaabd","observation_id":"c5ceb2f5-480c-40f3-931d-02b6243b41ff","resolution":{"observed_at":"2026-08-12T13:49:22.733505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.724685Z","title":null,"venue":null,"work_id":"84ed3fe1-e363-49c5-9dd3-f6ab97c4844e","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.593280Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:85c9ff41bef6a5aed166b234902350e0d0f6d184b91ae64ea8610507689ec1e4","observation_id":"b401951b-4a44-41c7-ba1a-a4cfc9ad7d49","resolution":{"observed_at":"2026-08-12T13:49:22.726771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.717493Z","title":null,"venue":null,"work_id":"8943a025-7c86-4904-80a2-d3824c6faacd","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.595268Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:fca59ffaebbb6e6ebdc956e691e0b928efa90a1afae3ff8a0583595e4a677760","observation_id":"831c091e-1f53-4432-b106-10e4be9b3718","resolution":{"observed_at":"2026-08-12T13:49:22.719543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.708997Z","title":null,"venue":null,"work_id":"22e85ccb-bbd5-44e9-853c-d854333b650c","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.597415Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:529275bf5123b843f7cdfa5112a1df137220a5e70db73b66c06164ff87edda84","observation_id":"85c5164e-2f7a-4d30-8605-cac959ef08ba","resolution":{"observed_at":"2026-08-12T13:49:22.712371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T13:44:15.959040Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2411.15891."}