{"as_of":"2026-08-14T17:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0c3f51e320c1bd5fb3680ac7bd29de1e0dae6b4eeed2a3c6f64a6dc002d4cf6","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:45:05.543512Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17795/citation-record","integrity":"/paper/2505.17795/integrity","json":"/paper/2505.17795/citation-record.json","paper":"/paper/2505.17795"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:08.679621Z","title":null,"venue":null,"work_id":"3bf8de0a-f7a0-4f3e-86e4-5eb846e8f6d8","year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:04.360778Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:02d56356476a2b4cdfbaee86865f893cb874a6b817acadf283b2f9fd6bf0bce6","observation_id":"e4d50b19-52a5-435b-8b5f-f5d45e776197","resolution":{"observed_at":"2026-08-07T14:45:08.800899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:08.427509Z","title":null,"venue":null,"work_id":"04da349a-8b7c-4840-84f1-5f1b20f82926","year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:04.487068Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:f17b3ab7da3d7ce651b9202469fe7055d45c69ea134c384181c6bf88f513d978","observation_id":"0e985aac-c9b1-418d-a185-fbe73d840e2e","resolution":{"observed_at":"2026-08-07T14:45:08.563763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:08.153558Z","title":null,"venue":null,"work_id":"2f129681-8b9a-4648-952e-9524ab5c4076","year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:04.636802Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:c64da6e4ef14bb8a39c33f5174889c24260d63484761538db6f15f72c67708bf","observation_id":"6274500f-ab8b-429d-81c3-47f04abfe6ea","resolution":{"observed_at":"2026-08-07T14:45:08.307620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-07T14:45:03.683850Z","title":"Shibo Hao, Yi Gu, Haodi Ma, Joshua Jiahua Hong, Zhen Wang, Daisy Zhe Wang, and Zhiting Hu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:03.683850Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:eca803211aa9daf4f9af1327c65807ae7c6eeb7e998710cfc0c821403940cc1a","observation_id":"c05cc2ba-7616-497e-b903-44e2ed90b435","resolution":{"observed_at":"2026-08-07T14:45:03.683850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-07T14:45:03.812358Z","title":"David Silver, Aja Huang, Christopher J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:03.812358Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:db0d3b38d5f90a8d6cb2c62d9fe36f2604a0f8681f1fd651665b1ee436547e22","observation_id":"c64af7e9-f5b9-4365-945e-59f190d73473","resolution":{"observed_at":"2026-08-07T14:45:03.812358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10227","last_updated":"2023-03-17T19:50:51Z","snapshot_observed_at":"2026-08-13T12:22:25.698904Z","submitted_at":"2023-03-17T19:50:51Z","title":"Conversational Tree Search: A New Hybrid Dialog Task","version":1},"cited_work":{"arxiv_id":"2303.10227","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.10227","snapshot_observed_at":"2026-08-07T14:45:05.717093Z","title":"Conversational Tree Search: A New Hybrid Dialog Task","venue":"cs.CL","work_id":"c520e297-6c82-4d8b-b345-02eb5b03bc4c","year":2023},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:04.027094Z"},"links":{"cited_paper":"/paper/2303.10227","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:d6edfc94395cd982950a6042d970b4df22be6c10d120fab51b30b78cf91bdaa5","observation_id":"d3bc0cf5-81c3-482d-b345-59baec77a584","resolution":{"observed_at":"2026-08-07T14:45:05.841278Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11339","last_updated":"2024-01-11T16:25:01Z","snapshot_observed_at":"2026-08-13T10:29:49.412448Z","submitted_at":"2023-08-22T10:36:56Z","title":"ProAgent: Building Proactive Cooperative Agents with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11339","snapshot_observed_at":"2026-08-07T14:45:04.170030Z","title":"Xiao Yu, Maximillian Chen, and Zhou Yu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:04.170030Z"},"links":{"cited_paper":"/paper/2308.11339","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:f78bb0d6d60e464267fc535d7e1deb075bd2b61ee329a70b430f3e7ec030c0d9","observation_id":"fdf8747c-3921-4203-8758-66c9266eb4a4","resolution":{"observed_at":"2026-08-07T14:45:04.170030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:07.846385Z","title":"Your responses are auto-saved after each item","venue":null,"work_id":"523dd057-0b13-43c5-a050-e517bbf8faf2","year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:04.823665Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:59f59de256e6ca5765f1b6b862289f468ed17f2ca6280d106233b66d08ca9f31","observation_id":"a9534df6-4938-44d9-a324-a86b09c210e0","resolution":{"observed_at":"2026-08-07T14:45:08.023757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:07.501678Z","title":null,"venue":null,"work_id":"6290528d-ee29-4583-a786-4fb5c96e57a5","year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:04.965029Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:a197e7da896c110fa7a88cb2e4cb9a12361dad593b99668d740f733ec3bb7fb1","observation_id":"899b74b1-5d88-4a7c-aae6-6d65745cff9b","resolution":{"observed_at":"2026-08-07T14:45:07.642462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:07.129890Z","title":null,"venue":null,"work_id":"fe73db8a-5b96-4a14-b6d8-ae3623903737","year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:05.127621Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:31b265637adeae5a7439f41e1772380d03db627b60dd9d726b315b11e50035ff","observation_id":"faca043b-f8b3-4c1c-a2aa-c8aaf0e8f077","resolution":{"observed_at":"2026-08-07T14:45:07.331720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:06.779155Z","title":"Responses are auto-saved; log back in with the sameUser IDto resume","venue":null,"work_id":"d8d48661-c882-42b4-8828-4ed1888dc6f1","year":2024},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:05.325415Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:4379d23a7f24637faabe5d20ef099b25044545ba1d6940bc4f1a72b1891b92a7","observation_id":"d136a87b-5703-47cf-b4b5-a6e16fbb9c3c","resolution":{"observed_at":"2026-08-07T14:45:06.937990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:06.375477Z","title":"Policy LLM for {dataset}","venue":null,"work_id":"e9e40073-3b7c-41fc-ac99-85bc4fe7d503","year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:05.543512Z"},"links":{"citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:bc037d5698424e84e30cc34f06681102982bc2ca8ac8899505ba18d1171e06b6","observation_id":"ce2da252-b646-4b40-a78f-396f6d175fa7","resolution":{"observed_at":"2026-08-07T14:45:06.557148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.03645","last_updated":"2020-04-16T06:46:25Z","snapshot_observed_at":"2026-07-06T09:03:02.778928Z","submitted_at":"2020-03-07T19:31:08Z","title":"Generating Emotionally Aligned Responses in Dialogues using Affect Control Theory","version":2},"cited_work":{"arxiv_id":"2003.03645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.03645","snapshot_observed_at":"2026-08-07T14:45:06.073706Z","title":"Generating Emotionally Aligned Responses in Dialogues using Affect Control Theory","venue":"cs.CL","work_id":"97e0c7e3-5cdd-4438-864d-9b4a537a94be","year":2020},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:03.394545Z"},"links":{"cited_paper":"/paper/2003.03645","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:9cd2145d84e439f387d9d6a7b220f819eda278f5c4a023b4d860af926897ef58","observation_id":"889ae298-7e7d-4bc6-9be1-c3038f25c6af","resolution":{"observed_at":"2026-08-07T14:45:06.166992Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:45:03.927445Z","title":"InProceedings of the Fifteenth Work- shop on Innovative Use of NLP for Building Educa- tional Applications, BEA@ACL 2020, pages 52–64","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:03.927445Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:c75e6048433cc6e5792741786d2400cc137d4fa13f14861a4111da7fa98be93f","observation_id":"8521ef60-4d2c-471f-876a-f7578092d8b4","resolution":{"observed_at":"2026-08-07T14:45:03.927445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04242","last_updated":"2022-10-09T12:23:47Z","snapshot_observed_at":"2026-08-13T14:09:44.917930Z","submitted_at":"2022-10-09T12:23:47Z","title":"Improving Multi-turn Emotional Support Dialogue Generation with Lookahead Strategy Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04242","snapshot_observed_at":"2026-08-07T14:45:03.479133Z","title":"CoRR, abs/2210.04242","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:03.479133Z"},"links":{"cited_paper":"/paper/2210.04242","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:1eaf11b09799f460fae31928bb5d700fe3e16bb26ee43ad88d1b1e5bc0142202","observation_id":"3f8f2f33-fe71-46f3-9bfa-30c40a2c1e0d","resolution":{"observed_at":"2026-08-07T14:45:03.479133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10142","last_updated":"2023-05-17T11:55:32Z","snapshot_observed_at":"2026-08-13T11:40:19.842559Z","submitted_at":"2023-05-17T11:55:32Z","title":"Improving Language Model Negotiation with Self-Play and In-Context Learning from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10142","snapshot_observed_at":"2026-08-07T14:45:03.591088Z","title":"arXiv preprint arXiv:2305.10142","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:03.591088Z"},"links":{"cited_paper":"/paper/2305.10142","citing_paper":"/paper/2505.17795"},"observation_digest":"sha256:eadf31ae3bd71794f11bdcd5db24c0db6b967efdca3fa380ead69ab8cb3a7901","observation_id":"1cb7bb75-3b39-4219-b15f-a9e1e2969933","resolution":{"observed_at":"2026-08-07T14:45:03.591088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17795","last_updated":"2025-05-23T12:12:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T06:41:20.719035Z","submitted_at":"2025-05-23T12:12:40Z","title":"DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2505.17795."}