{"as_of":"2026-08-17T10:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d92b42247f09fee0590d060723a537de17ca5a9fe41d125c64ed4d3b30d5cc1","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:33.785748Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:22:49.446570Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:22:49.880807Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"cited_work":{"arxiv_id":"2505.24710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.24710","snapshot_observed_at":"2026-08-07T05:22:49.880807Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","venue":"cs.LG","work_id":"2588906c-b9f8-452b-87a5-ca5c7c5f82a3","year":2025},"citing_paper":{"arxiv_id":"2506.08134","last_updated":"2026-06-09T00:39:28Z","snapshot_observed_at":"2026-08-15T01:47:38.392853Z","submitted_at":"2025-06-09T18:37:14Z","title":"Position: The ML Community Must Build an AI-Augmented Peer-Review Ecosystem","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:22:49.446570Z"},"links":{"cited_paper":"/paper/2505.24710","citing_paper":"/paper/2506.08134"},"observation_digest":"sha256:8ddce4a754dee3ffeecc682d7fa74cea9775eb241251b8ef5d74a0caa1eb1dc9","observation_id":"1c5c943d-b0d0-47b8-bf4f-e306f2a7ca69","resolution":{"observed_at":"2026-08-07T05:22:49.886259Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24710","snapshot_observed_at":"2026-08-01T10:58:16.118523Z","title":"Causal-aware large language models: Enhancing decision-making through learning, adapting and acting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22732","last_updated":"2026-07-22T12:10:45Z","snapshot_observed_at":"2026-08-13T22:18:28.174385Z","submitted_at":"2026-07-22T12:10:45Z","title":"Spatial Reasoning in LLM Game Agents: Impact of Causal Context and Multi-Step Planning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T10:58:16.118523Z"},"links":{"cited_paper":"/paper/2505.24710","citing_paper":"/paper/2607.22732"},"observation_digest":"sha256:293ee31fce312accec904be8843b673814c4ecd1092a436f7c63bab936ef11af","observation_id":"2edb161f-e51e-48b5-832c-ff321df8db3a","resolution":{"observed_at":"2026-08-01T10:58:16.118523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24710/citation-record","integrity":"/paper/2505.24710/integrity","json":"/paper/2505.24710/citation-record.json","paper":"/paper/2505.24710"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:38.479844Z","title":"Cause and effect: Can large language models truly understand causality? In Proceedings of the AAAI Symposium Series , volume 4, pages 2--9, 2024","venue":null,"work_id":"596c72e3-be32-43fc-8bcc-5d7ad4dd2f4e","year":2024},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.851997Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:d3e4a5f3c58f65546f6840bf517ece5f4edf0b1728756075aa8486cb2e43a974","observation_id":"e6dbf483-a068-4b82-8a78-bd1547bf81dc","resolution":{"observed_at":"2026-08-07T12:35:38.632895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:38.345392Z","title":"Vision-language models as a source of rewards","venue":null,"work_id":"9cff23af-6ff6-42a3-b25f-10ed14b251a0","year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.933176Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:87e0ba81d8a824bae1a76de972156e7f582235ce4608d810a8ee2ad73a9113b5","observation_id":"bd11f749-6309-40af-a42b-2807c898ca6a","resolution":{"observed_at":"2026-08-07T12:35:38.401832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.015770Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.015770Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:2828f047ece4a772ae986843b9f9880b555e89f1d7130560b5f854ee030d2d7e","observation_id":"71e39bf4-863a-4f33-9b19-01888c7803b9","resolution":{"observed_at":"2026-08-07T12:35:31.015770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:38.148784Z","title":"Granger causal representation learning for groups of time series","venue":null,"work_id":"e8d362d4-34de-4041-af72-2a3961da8e7b","year":2024},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.104903Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:45f547efb17ad3175f2cd29074b16d9d109d389c1c44a5a401b6084ba74be225","observation_id":"92cf083b-7a2b-42ae-9368-1ef4515e5b3d","resolution":{"observed_at":"2026-08-07T12:35:38.234049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:37.938093Z","title":null,"venue":null,"work_id":"501a5135-4ea3-4ebf-8a5d-2d3cdc77252a","year":2024},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.177473Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:0519e0055c5e43dd99b9c9a224b7274345a3e6924f21c353a05e2e7c4ff221c6","observation_id":"b282b8e7-7485-4d41-97a1-637186aadd56","resolution":{"observed_at":"2026-08-07T12:35:38.026679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:37.731442Z","title":"Guiding pretraining in reinforcement learning with large language models","venue":null,"work_id":"5f6e9dde-febf-4a12-99bf-e024c8587646","year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.252446Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:652bc2f9e7f6ab3a753115d5d23e41f712b059fd1155e5923ed3e69173571d80","observation_id":"9009e3d2-25e5-4477-916e-f41250a4cce0","resolution":{"observed_at":"2026-08-07T12:35:37.815722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:37.568312Z","title":"Is C hat GPT a good causal reasoner? a comprehensive evaluation","venue":null,"work_id":"411649dd-b19a-4e89-a3e9-3ca51f1a12f8","year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.346757Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:f0d6ded9feece75c581540c7f017ed9484b1b6890d77985d1d6ee7eed6ebd591","observation_id":"dfbd7fa3-a857-4f50-93fe-865243e99c1e","resolution":{"observed_at":"2026-08-07T12:35:37.631648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:37.356045Z","title":"Mastering atari with discrete world models","venue":null,"work_id":"b45a1401-1002-4dcf-9c6d-88d0b7bf7b7b","year":2020},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.416953Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:c0b214b71ebd3bff01b386e5fd4f71e59d86a4faeed2b7cb6cd37985824356a9","observation_id":"f8a38d71-8c19-4772-963d-6804917c33ac","resolution":{"observed_at":"2026-08-07T12:35:37.466478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-07T12:35:31.489453Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.489453Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:5f1b73978f50884cec2736a23708c217dd9bcb0fcc4b4d3fed47f051692b437f","observation_id":"6a89f984-2196-45ad-9335-59a7a0b34c89","resolution":{"observed_at":"2026-08-07T12:35:31.489453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:37.207272Z","title":"Benchmarking the spectrum of agent capabilities","venue":null,"work_id":"a34e6f01-5c61-4982-8429-107d02e6097e","year":2021},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.586817Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:995f923346af4d47c9e8b9df825c193f6e49429803bc28c651fe4b7eab6f862b","observation_id":"7fb83907-a0f4-4e61-9caa-485c4f7618ea","resolution":{"observed_at":"2026-08-07T12:35:37.274734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:37.037623Z","title":"Benchmarking the spectrum of agent capabilities","venue":null,"work_id":"6e24166f-8573-4ba5-930a-286804e37760","year":2022},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.632463Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:c168f6143585f0b9373ac67a622cfdf15574becf2cd318b24d70376ecf29c2b9","observation_id":"69bbc948-b411-4129-b777-13eba86d9db2","resolution":{"observed_at":"2026-08-07T12:35:37.111999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.714870Z","title":"Rainbow: Combining improvements in deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.714870Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:c8eac7d37675dfaa24c3a9da6036a66f26278e6d0475e3d1487203cfab266775","observation_id":"1656aa4d-6004-413c-bfe2-3cea82176551","resolution":{"observed_at":"2026-08-07T12:35:31.714870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.793604Z","title":"Thinking, fast and slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.793604Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:d7ed324fd73efc11c0db221ebfc7a77b01c7fbb77eaf1f54e768610043d38b8a","observation_id":"6d3851cc-dfe4-47e4-8508-cdf7899d4a80","resolution":{"observed_at":"2026-08-07T12:35:31.793604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.829728Z","title":"Deep reinforcement learning for autonomous driving: A survey","venue":null,"work_id":"f5a9c67f-6491-4faf-b644-6be51dd48153","year":2021},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.950732Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:9a7cdb4dfca5d7f095f300c2659d70287c036b828cc2dcf41dbf472419d5f092","observation_id":"738bcebe-ce3f-4efe-8f03-823d717154f3","resolution":{"observed_at":"2026-08-07T12:35:36.913781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.605701Z","title":"Reinforcement learning in robotics: A survey","venue":null,"work_id":"40a2fc36-d2ff-4452-9b09-7b4a79746d00","year":2013},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.081546Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:3f43c01b754907081e116a63bfd079a934a854d905d0effb69188398512d221d","observation_id":"012d7208-8aa3-4465-bc97-0bf87a916eac","resolution":{"observed_at":"2026-08-07T12:35:36.671205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-07T12:35:32.199430Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.199430Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:104b92aa77b7d057c88adb529945e1e903ebda1cd3ba2bb73bd32c63fb3418ee","observation_id":"7e13cf59-52e1-4507-b503-13929c6e7c58","resolution":{"observed_at":"2026-08-07T12:35:32.199430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.382750Z","title":"Goal-conditioned reinforcement learning: Problems and solutions","venue":null,"work_id":"c07a748c-513b-4069-81b8-cbc43fd0f408","year":2022},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.293110Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:12f1784e542339c9344d5c06006688df33deb17a5d4a0a39910f0be2b9985ba2","observation_id":"033b8727-1f6c-4c47-93d0-e376b901417b","resolution":{"observed_at":"2026-08-07T12:35:36.485691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T12:35:32.385308Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.385308Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:2f1be89ad84aac7447d106344b169fe1e34eac617863da131f158c7d2a1b6550","observation_id":"1e663b93-050c-4026-980b-d64d817eb0d8","resolution":{"observed_at":"2026-08-07T12:35:32.385308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.125255Z","title":"Asynchronous methods for deep reinforcement learning","venue":null,"work_id":"4ddfd878-4acb-4226-bd21-642274d7ca38","year":1928},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.474444Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:09bb56a9de9a9ad889acb52bd84fb741ddc6d5af5e4125dd33523fd56d35bce0","observation_id":"6e131b18-e951-480c-b550-ee78186d90e5","resolution":{"observed_at":"2026-08-07T12:35:36.311066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:35.789649Z","title":"Discovering hierarchical achievements in reinforcement learning via contrastive learning","venue":null,"work_id":"3c81bfe0-8a58-455c-9299-7b3b404d147d","year":2024},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.570099Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:428f258fec6773336e53b19fc906896e4fad61094ffe73674cb4b5128797ed4c","observation_id":"888353b6-0f3b-47a8-9c28-0ccc090d5415","resolution":{"observed_at":"2026-08-07T12:35:35.928560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.684725Z","title":"The book of why: the new science of cause and effect","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.684725Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:421f0ed5d2003802510748b96e44d1bc39ac9bf67ff492427e8f13057c46a845","observation_id":"70bfe095-c092-4809-b42d-6ac1c4358d81","resolution":{"observed_at":"2026-08-07T12:35:32.684725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.762459Z","title":"Causality","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.762459Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:4405c2ff7e4409c4e313f500ffa935478f33a875cc449463c00b30f53d1135af","observation_id":"bf007c51-2ad4-4fb4-81f0-3739b4884968","resolution":{"observed_at":"2026-08-07T12:35:32.762459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:35.353725Z","title":"Trust region policy optimization","venue":null,"work_id":"b05bd8ba-c284-45f3-b31c-60092a492c67","year":2015},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.852793Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:51d9224c0750cd8cd014770b91c1d23296d3a90966b728043381991d163b4941","observation_id":"b794e016-fad0-42f2-9dfc-bc33df98af99","resolution":{"observed_at":"2026-08-07T12:35:35.505181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:35:32.915213Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.915213Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:eb540746ed37218bc73562f8aa6b426b8f49135141204b72a87547a7c7d6c183","observation_id":"fb4a8e99-61fe-4f51-80bf-3f2b115d16b5","resolution":{"observed_at":"2026-08-07T12:35:32.915213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10944","last_updated":"2019-12-26T14:47:34Z","snapshot_observed_at":"2026-08-16T18:32:40.755614Z","submitted_at":"2019-12-23T16:04:40Z","title":"A Survey of Deep Reinforcement Learning in Video Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10944","snapshot_observed_at":"2026-08-07T12:35:33.005100Z","title":"A survey of deep reinforcement learning in video games","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.005100Z"},"links":{"cited_paper":"/paper/1912.10944","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:d9a98a5f88a24fd1c3217705af0b68abd1f62202672988c71c2789f4f9d4e18c","observation_id":"f8ab642d-44f0-4541-9831-125b6c82a464","resolution":{"observed_at":"2026-08-07T12:35:33.005100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-08-15T16:12:25.059113Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-07T12:35:33.069608Z","title":"Reflexion: an autonomous agent with dynamic memory and self-reflection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.069608Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:ad0426b8c3842357c5b2b3e4f24834137f40dba32b7c777fd3b3de7ff614c6a8","observation_id":"5b8c7e74-4e70-46cd-a28b-b9f90beb5a9f","resolution":{"observed_at":"2026-08-07T12:35:33.069608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:35.026316Z","title":"The optimal control of partially observable Markov processes","venue":null,"work_id":"8a9789ce-b4df-4f5e-b791-8c458e56258c","year":1971},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.144113Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:cd14347640fe910f33768f779565988b4a83f0c30f532337a80addb2aedb1ca0","observation_id":"7248cf11-84ea-4b46-86dd-91f44e7158ac","resolution":{"observed_at":"2026-08-07T12:35:35.171341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.736936Z","title":"Adaplanner: adaptive planning from feedback with language models","venue":null,"work_id":"b317aab1-3235-4cf4-9bb5-831c80a9d6d3","year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.262333Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:6c3658517ab56a311235c2828fe43cdea18ec4c943425c41376dffc8a32c7303","observation_id":"f830e0a3-6b27-4b1f-b1a8-0a626545669b","resolution":{"observed_at":"2026-08-07T12:35:34.911072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T12:35:33.331555Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.331555Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:255d584765e0d485308433d14afc66f455875214c5c48a1a6dd24460cd82cb9e","observation_id":"29cd206a-9d4e-4a6f-9b01-2cc0ef5c04de","resolution":{"observed_at":"2026-08-07T12:35:33.331555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.556995Z","title":"Learning from delayed rewards","venue":null,"work_id":"5bfe56fa-1642-482c-bac0-31c7d045d38e","year":1989},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.400804Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:76401e7fd55332278bdbf200572854ff26720afa19274b7e6d7453951dce238a","observation_id":"a83aca61-7ce2-4b41-a7ba-e8926d7eacf6","resolution":{"observed_at":"2026-08-07T12:35:34.645760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.471798Z","title":"Spring: Studying papers and reasoning to play games","venue":null,"work_id":"e5f0959e-4685-46be-9745-6b87937f60de","year":2024},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.452908Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:93deb7eeae9e90c5f3713fa4390643962756cf75d3535851c0485a1569bc7479","observation_id":"c9153d2b-5b5d-42f8-bb44-85a53e882de9","resolution":{"observed_at":"2026-08-07T12:35:34.536469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.261627Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":"63733a40-9508-4d3c-ac5a-bcaec0a0e1ba","year":2023},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.520134Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:003ad3a120eef4e890d05f4657c216195c63972b7444574816b661aaab94df63","observation_id":"79e33a58-8c1b-4a4c-af1e-6d8df297371d","resolution":{"observed_at":"2026-08-07T12:35:34.373662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.062008Z","title":"Adarefiner: Refining decisions of language models with adaptive feedback","venue":null,"work_id":"0c7ac3d7-aa93-40a8-ba92-5360c9c3689a","year":2024},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.598496Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:850faa351fe4349f0717f9cc6dfb82a9c8738dea3256ebdac4cbea52fd47c8cd","observation_id":"1b0703b5-4311-4878-8404-c60201945172","resolution":{"observed_at":"2026-08-07T12:35:34.127958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15301","last_updated":"2024-06-18T05:51:50Z","snapshot_observed_at":"2026-08-16T14:15:54.631929Z","submitted_at":"2024-02-23T13:02:10Z","title":"Causal Graph Discovery with Retrieval-Augmented Generation based Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15301","snapshot_observed_at":"2026-08-07T12:35:33.695962Z","title":"Causal graph discovery with retrieval-augmented generation based large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.695962Z"},"links":{"cited_paper":"/paper/2402.15301","citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:13b294592274c71bd3cbda41f1a5e49e6fc1da5c198d4eccddb0f59cdb3f4fd8","observation_id":"1a3297d7-77ec-4d5d-9e1e-9b241beb347e","resolution":{"observed_at":"2026-08-07T12:35:33.695962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.785748Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.785748Z"},"links":{"citing_paper":"/paper/2505.24710"},"observation_digest":"sha256:7700576def85be2e33b938cbf2bc77fb6382f10a53073035a9c735b609dd9ece","observation_id":"a2b3ad90-190e-477c-99e9-c83bf12c2c7b","resolution":{"observed_at":"2026-08-07T12:35:33.785748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24710","last_updated":"2025-05-30T15:30:44Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T22:40:04.825120Z","submitted_at":"2025-05-30T15:30:44Z","title":"Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 2 inbound Pith citation observations for arXiv:2505.24710."}