{"as_of":"2026-08-11T01:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:478e38f18c76d6e6bd8cd3b2c6fe7fe4d8dcd713fe7aaac308e647843a1c2b84","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T17:24:18.413112Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.03671/citation-record","integrity":"/paper/2604.03671/integrity","json":"/paper/2604.03671/citation-record.json","paper":"/paper/2604.03671"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:82462ec1f45bb9795a65b6f5407d03bd234557381f624f3fa3d9dbf4698fff99","observation_id":"a60fa691-d7d3-4548-bf20-25b99dd0107a","resolution":{"observed_at":"2026-05-13T17:28:02.569739Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:bcd51030d99b83d1abc43e91861026001037a88add8749e5e7604c5ece61a4b8","observation_id":"308d31df-aaf2-4d81-b378-3aaff320362c","resolution":{"observed_at":"2026-05-13T17:28:02.579228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"56b57022-b38b-4812-b741-272d8a897078","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:f3741c390f04e40edc9a67064178b4305e298746b54c468fe452d2e86b308a13","observation_id":"2441cb29-c57c-4546-9ce9-fe5f29bfcb97","resolution":{"observed_at":"2026-05-14T04:56:43.723712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.05391","last_updated":"2019-09-03T04:38:02Z","snapshot_observed_at":"2026-08-08T03:17:53.949174Z","submitted_at":"2019-08-15T01:49:19Z","title":"Towards Knowledge-Based Recommender Dialog System","version":2},"cited_work":{"arxiv_id":"1908.05391","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.05391","snapshot_observed_at":"2026-07-10T21:47:36.109580Z","title":"Towards knowledge-based recommender dialog system","venue":"cs.CL","work_id":"ed1c5f0f-f56e-4e26-92bb-7e0d0d5f3244","year":2019},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/1908.05391","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:83aab8bd9e1c3059a3bd3856bb7336057ab6ee5d76fa2d77e795fad937ecd036","observation_id":"b3e2838a-8fe2-4dc6-8776-128492e4ea0a","resolution":{"observed_at":"2026-05-13T17:28:02.552716Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"04939f3c-2898-4528-af18-14f800c6c23f","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:2da91f861dd7ecbe886584c4022e761f896c8675e7f9340350307fde009179ea","observation_id":"5d786333-b7ba-4914-a7d6-2e516a273223","resolution":{"observed_at":"2026-05-14T04:56:43.727070Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":"2307.08691","doi":"10.48550/arxiv.2307.08691","metadata_source":"pith","pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","venue":"cs.LG","work_id":"fff3953b-5efb-4753-bee4-002f59995810","year":2023},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:d94c7c70fc608a5777592a06528014923c4ba84c08676caa6c85713530524683","observation_id":"f15adabc-27c2-4509-af79-f27e2c7af84c","resolution":{"observed_at":"2026-05-13T17:28:02.557958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:18.243793+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:18.243793+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:47:36.958333Z","title":null,"venue":null,"work_id":"eff1e67b-52bf-44d0-8a36-059e0da7172b","year":2021},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:6c5a83aef71f70396d73e63723a069025be90de9b824e75ab437ca1efda21d3b","observation_id":"29704da0-1f17-411a-b3e5-ea26e103c6dc","resolution":{"observed_at":"2026-05-14T04:56:43.718017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:45:27.558250Z","title":null,"venue":null,"work_id":"7e7dc025-2070-4919-b779-b3aad9a11853","year":2019},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:c624ca79ee1da91b961fa6c8930ad19f8a7090f02267da3d958b154a44e7a270","observation_id":"5a1029c8-16fb-4d90-b428-0600ef36fe00","resolution":{"observed_at":"2026-05-14T04:56:43.711573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f8eeb0a0-674d-4763-84c7-15939168e461","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:02f4e30479a18d1e29e2c23d6b3af4d491027d35116ea32e3a0dbc4aab50ab0d","observation_id":"f81f69ca-3d6b-4a5d-b60b-525a22a58f33","resolution":{"observed_at":"2026-05-14T04:56:43.714590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:16:06.526490Z","title":null,"venue":null,"work_id":"6d35d3b2-5bfb-470a-8771-9513c607d8b6","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:a742f7df32d6e0f472edd149043ca2218fdb30f5a6736c618b0c2fdcb9bfd453","observation_id":"e13b5a21-6c3f-4a8b-b10c-a3ab2200aa21","resolution":{"observed_at":"2026-05-14T04:56:43.720897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02061","last_updated":"2026-07-28T04:34:05Z","snapshot_observed_at":"2026-08-09T23:45:11.620615Z","submitted_at":"2025-02-04T07:17:54Z","title":"Reason4Rec: Deliberative User Preference Alignment of Large Language Models for Recommendation","version":3},"cited_work":{"arxiv_id":"2502.02061","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02061","snapshot_observed_at":"2026-07-29T01:24:22.003827Z","title":"Reason4rec: Large language models for recommendation with deliberative user preference alignment","venue":null,"work_id":"4a2b30f4-5d8b-412b-8de6-6c3e5fc7a537","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2502.02061","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:68af45dbdb98fb5326d4f51eed8058e6385dcf830f1ccf6c2c00614eec8b2701","observation_id":"47e25540-5bab-4112-a26a-419275d6d988","resolution":{"observed_at":"2026-07-29T01:24:22.003827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14302","last_updated":"2025-06-17T08:29:04Z","snapshot_observed_at":"2026-08-07T00:15:33.274266Z","submitted_at":"2025-06-17T08:29:04Z","title":"Expectation Confirmation Preference Optimization for Multi-Turn Conversational Recommendation Agent","version":1},"cited_work":{"arxiv_id":"2506.14302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14302","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1ac06ca6-f217-4327-87b3-76883e0f3a33","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2506.14302","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:5d0b399f318ecd8b817071c60248e0712c21b109e8d07d003aec56ac9409f1f6","observation_id":"a74804a0-4f5c-410d-b940-ffe5f5dd471a","resolution":{"observed_at":"2026-05-13T17:28:02.593141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:d008dea9d8d76adbf9cda52050f0b76996fbc4710c4277f0c613c9b3f6a9e0e5","observation_id":"ebf2ccc6-22f5-4fad-a687-e7dca2827336","resolution":{"observed_at":"2026-05-13T17:28:02.590918Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14306","last_updated":"2020-10-08T06:17:22Z","snapshot_observed_at":"2026-08-07T10:05:06.383853Z","submitted_at":"2020-09-29T21:03:44Z","title":"INSPIRED: Toward Sociable Recommendation Dialog Systems","version":2},"cited_work":{"arxiv_id":"2009.14306","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.14306","snapshot_observed_at":"2026-07-10T21:47:36.087403Z","title":"Inspired: Toward sociable recommendation dialog systems","venue":"cs.CL","work_id":"1f0be892-a469-4d15-8ea4-458c7f327cfc","year":2020},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2009.14306","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:0697c4412b07e25d1d6232e52d8719266a2550dae13b37780a1697987de16a35","observation_id":"e8eb26db-3adb-4d28-baf9-2884686d27f7","resolution":{"observed_at":"2026-05-13T17:28:02.572292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2eb348ad-0ec0-4141-b1c8-b2534d486688","year":2020},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:e4fe7e1cff7288cda007476801653768088d27bb23c1f8879d33ea9c5628034f","observation_id":"dfd277be-dbcf-4136-b0e7-91674b615efc","resolution":{"observed_at":"2026-05-14T04:56:43.730200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7c924e0c-9e62-48bd-a345-a6a2715412bb","year":2023},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:20164a2f83ed23622e38d7f37797aeeb107f484ca283e314bfe790f2ca4f12a5","observation_id":"273694fc-4406-4c8c-9ee7-080dc8823535","resolution":{"observed_at":"2026-05-14T05:01:59.273800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:47:36.916545Z","title":null,"venue":null,"work_id":"3fddd64a-cade-4050-84aa-8999a9bf92fa","year":2022},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:6844965acdeb8a70109fbff5e5ba161f34c1aa103a00321fdbb09c4fb8530fb1","observation_id":"a68ca345-ebf7-4000-bf75-0d05b68b4b7f","resolution":{"observed_at":"2026-05-14T04:56:43.733060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02716","last_updated":"2024-02-05T04:25:24Z","snapshot_observed_at":"2026-08-10T13:27:24.204831Z","submitted_at":"2024-02-05T04:25:24Z","title":"Understanding the planning of LLM agents: A survey","version":1},"cited_work":{"arxiv_id":"2402.02716","doi":"10.48550/arxiv.2402.02716","metadata_source":"pith","pith_arxiv_id":"2402.02716","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding the planning of LLM agents: A survey","venue":"cs.AI","work_id":"6daa5311-7f56-401d-94db-17be43e95cbc","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2402.02716","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:0b0b451dc1e0e935390476d12f75cb9e8939dd7542d49ec62f7a1afd87510705","observation_id":"0cb8bc96-56d7-43bb-9909-04af1a13759b","resolution":{"observed_at":"2026-05-13T18:12:57.765583Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T20:20:12.598477+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T20:20:12.598477+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c82f1eaf-4c4b-48da-9d75-29ad697c8aaa","year":2020},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:d8295c1b1d52b6651ebcbad5dfcfccfc1a6660630de89cf0c57cb5bbb5e6bf21","observation_id":"028a9c3a-c79d-42a0-9d83-ea8a096f1963","resolution":{"observed_at":"2026-05-14T04:56:43.705207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2afc24f4-8510-4f8c-80e6-6766615dca9e","year":2020},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:9d5484cdadf0421947d89ba22b8451107c89ba6e74a76c6e71ca7d3b1c8dc0b4","observation_id":"8ba94241-7c58-4434-9cae-1bec55bd9d4d","resolution":{"observed_at":"2026-05-14T04:56:43.676500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dc266756-3efa-48d5-bc4e-6f8428f5e606","year":2018},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:b7afe43cfad2c0706a29c2abc67f8f1f5a9e96bfbbf0f0d7d2bf9da60286e317","observation_id":"01a2f84b-3799-4cbb-817f-7a4bccc0cee1","resolution":{"observed_at":"2026-05-14T04:56:43.693326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10543","last_updated":"2023-07-20T02:48:04Z","snapshot_observed_at":"2026-08-02T16:05:46.671730Z","submitted_at":"2023-07-20T02:48:04Z","title":"TREA: Tree-Structure Reasoning Schema for Conversational Recommendation","version":1},"cited_work":{"arxiv_id":"2307.10543","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.10543","snapshot_observed_at":"2026-07-10T21:47:36.106816Z","title":"TREA: Tree-Structure Reasoning Schema for Conversational Recommendation","venue":"cs.AI","work_id":"47cafb1c-bc32-46d1-b1ac-1c17e32bf372","year":2023},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2307.10543","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:f3b80b6a37b912bc5a1a1848ca9c2d34a8703d9bf2dcc9bdc6080e37a6f0cfb1","observation_id":"d5aa0ac5-1723-4efb-b005-9d19a6fef7b4","resolution":{"observed_at":"2026-05-13T17:28:02.574517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12388","last_updated":"2024-06-09T00:58:25Z","snapshot_observed_at":"2026-08-03T23:11:21.774104Z","submitted_at":"2024-03-19T02:57:07Z","title":"Interpretable User Satisfaction Estimation for Conversational Systems with Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.12388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12388","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpretable user satisfaction estimation for conversational systems with large language models","venue":null,"work_id":"c64aaf5a-39d2-4d40-832e-952ec008eb12","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2403.12388","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:3a091e85ffb04b47669b54e352c44b5935f0c5f9b9e83fd85ab56a252bb1648f","observation_id":"c25b82a4-19bd-4c0f-bbc1-44de6444d413","resolution":{"observed_at":"2026-05-13T17:28:02.576902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a6c9f17e-039f-4607-84ca-9634225d2806","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:286efaa95fcf4d13f7b733f78c457dd6baabb80eacb5a2443bcfae709bfb705a","observation_id":"6e51fa45-69be-4f1b-8f70-e528df3c5b2c","resolution":{"observed_at":"2026-05-14T04:56:43.689989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4525d64f-9ecc-4101-b628-a63b64079d50","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:0bb5a4c5ce42b509a826acd299006a64b0d3393ec196428488f8cfac7aa19bf0","observation_id":"d72ba797-37f9-49cd-a004-493f21d9fa47","resolution":{"observed_at":"2026-05-14T04:56:43.708652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-10T17:28:59.378726Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":"2501.12599","doi":"10.48550/arxiv.2501.12599","metadata_source":"pith","pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","venue":"cs.AI","work_id":"bff96ab1-bd6a-4585-be23-74fdb51969c7","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:e4ee6ca5e34ae6258cedc8207f1d24a69d9a2c0562f5bfa88219b03d76e70726","observation_id":"ec9dcb02-e7e4-4e58-b2df-6e07fa1ba4e6","resolution":{"observed_at":"2026-05-13T17:28:02.588760Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"63bc9a6f-d750-4985-a19a-eca0f5f8d8dd","year":null},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:3cb315b5454c0e00a6360a99e8d0af5c7c5898b18a18f3dfde2328fef7fa1195","observation_id":"f041ecf3-85dc-44c3-8e28-70dd0af20441","resolution":{"observed_at":"2026-05-14T04:56:43.653029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13112","last_updated":"2023-11-03T02:49:46Z","snapshot_observed_at":"2026-07-06T15:30:42.173342Z","submitted_at":"2023-05-22T15:12:43Z","title":"Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.13112","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13112","snapshot_observed_at":"2026-07-04T12:09:48.844608Z","title":null,"venue":null,"work_id":"fb907044-4cdc-4ed2-8807-9a7d0c53bb63","year":2023},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2305.13112","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:12e0da12276a54c01e0d6b0ae78426fcfd44b9070518c9b1ef1f348347aabb5b","observation_id":"d77f9783-2dc2-4850-baaf-cc2c74673aaa","resolution":{"observed_at":"2026-05-13T17:28:02.584217Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:4a46024571ad53ad7cae81a4aca4aa4021a6c6940cb6a2e10c203421429a5536","observation_id":"1cdb594e-04ff-4cd8-afe3-15fafc75e9e2","resolution":{"observed_at":"2026-05-13T17:28:02.586506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"667bbc48-62f5-4207-955e-ce8f12c14b42","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:ee8c0ace2dba590b76b85e0000212a285a0b2b46616fd2103ec0dfd0da8cb7be","observation_id":"599af5dd-af9b-46c8-b52c-4d045d7528ab","resolution":{"observed_at":"2026-05-14T04:56:43.659872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f2db0a01-794a-4b7d-8d97-f44852ed40ff","year":2022},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:2351fea9f595256bf048c664bfdf20399d5032645feb85dc0992fb6a40ffe213","observation_id":"5dcbc4ec-2c5f-4170-93fa-581ddfc3717b","resolution":{"observed_at":"2026-05-14T05:01:59.281505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"65e0dfc2-08eb-4a02-8403-b9c8e239414a","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:c9393f9eaa992e96b42ae9d6eeb8c6e337d02705cace0361e97d10616ab4e487","observation_id":"e2491c63-1967-43b0-8347-be89ac3d190d","resolution":{"observed_at":"2026-05-14T05:01:59.284471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:02:29.513226Z","title":null,"venue":null,"work_id":"dea70e32-4554-4ae1-a7b9-e3bf50a7c5cf","year":2022},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:d5a4c650b79bb06cb05f46deb11428fb503f0c04498290922fc788d5b0da823a","observation_id":"a5a9a7be-77f1-4bca-86fb-a31139d56565","resolution":{"observed_at":"2026-05-14T04:56:43.662854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f5442dd9-6e80-4ad7-bb5d-df0e73a7abe4","year":null},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:3b33cdae19f808e7a2dab97fda177a6f56198cc31fdd5039c619098406dfdf03","observation_id":"987cde7b-0c35-494a-b4db-787440a10770","resolution":{"observed_at":"2026-05-14T05:01:59.290867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the 48th International ACM SIGIR Conference on Research and Development in Information Retrieval","venue":null,"work_id":"73116ade-0fcd-4e0d-ac3c-22046a6f405a","year":null},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:e0e5524b3b81486b90e9d64d09689778bf1e9fd8ddec7921780866b1a9c382ee","observation_id":"5462c1e8-77b5-4213-a0e0-39e99fb4b8ea","resolution":{"observed_at":"2026-05-14T04:56:43.666184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"98d1cbb0-c803-49ae-beb8-bf5c32c75566","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:9d1ff36c5a15a3149e55abd896f9e0945b288e70e1b333d04b364c6e66a4b786","observation_id":"2f9f2e82-a7f4-48a7-907b-55993568d688","resolution":{"observed_at":"2026-05-14T04:56:43.669291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cbb034dc-412f-4b1a-9b79-8f56382fdaf8","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:e95850219b12ed533565377dd2ab472e3ac0d389c3039f1fa4c72fc6e9ebb497","observation_id":"6eb9c1a2-906f-4942-9764-f8fa503dcee6","resolution":{"observed_at":"2026-05-14T04:56:43.683595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d2219560-e739-46af-9e48-089255469c35","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:e9858f84c905b5a88b2414275807db55cead4e0aed944ace4a2e3ecea6c0c529","observation_id":"aee1599b-a417-4a51-b6b5-aa66acf5a5d4","resolution":{"observed_at":"2026-05-14T04:56:43.702370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b61cd66e-9a4d-4a1b-99e5-5d2421614c77","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:6fe5b9da68086a0de8b4e87278cfc9ed35a1b074c2a0502c3da4d888460c49a0","observation_id":"a40a7d97-b9e0-450e-8449-3258e35e200a","resolution":{"observed_at":"2026-05-14T04:56:43.699182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"57176964-a215-4249-9009-a3cad203e3ee","year":2021},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:f3a098afcb796130296fb0c12a42a9e13a6cabe388b453ac2fd185d930db4233","observation_id":"566cb346-df81-458b-8619-2ded5a40db4b","resolution":{"observed_at":"2026-05-14T05:01:59.287256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:47:36.909095Z","title":null,"venue":null,"work_id":"05b83a14-843f-480d-b86c-465f58f68217","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:36d7f88fd51c432e02085c8cee04a91320f99f6dd7820f30c600fb76293cea69","observation_id":"f256212c-9404-4c44-aa3a-dc9348ff74c4","resolution":{"observed_at":"2026-05-14T05:01:59.278566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09738","last_updated":"2024-03-25T23:53:01Z","snapshot_observed_at":"2026-07-06T17:44:49.990624Z","submitted_at":"2024-03-13T18:16:21Z","title":"Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation","version":4},"cited_work":{"arxiv_id":"2403.09738","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09738","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"77b3ac86-c334-463c-a4f9-b89425f462b0","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2403.09738","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:1ac7994d75385fd9b2764fa33b324b3ea4af0787023341489a158591fa220940","observation_id":"951d67df-b2b8-4798-8972-b540732cfc64","resolution":{"observed_at":"2026-05-13T17:28:02.562737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:11ee23ce73766aafd57cbca28aed154bf04deb595457c8ff42f86f38d831db5c","observation_id":"99d4ef0e-2021-485e-9540-51c26da98b08","resolution":{"observed_at":"2026-05-13T17:28:02.560347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-08-10T18:23:47.368788Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":"2504.05118","doi":"10.1109/access.2024.3384487","metadata_source":"pith","pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","venue":"cs.AI","work_id":"c2351652-65f7-47cd-ae80-dbcd72a6eb20","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:f7e45fc9b374bddcb5e7bb4f16ec556baefef046b00ed5f8a62349dc29803722","observation_id":"191891a1-b127-4f5c-8b5d-3b0e56f91998","resolution":{"observed_at":"2026-05-13T17:28:02.564997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f47c7674-3c5a-4244-8e9b-ff3e7aa9b796","year":2023},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:955983997a7a530d85bbf2f54a6b8d5a5f9c0e5cc08e75e5757f819797566eed","observation_id":"575f6653-3aac-45bc-87bc-eda8e7843a18","resolution":{"observed_at":"2026-05-14T04:56:43.680539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05069","last_updated":"2025-06-09T09:08:12Z","snapshot_observed_at":"2026-08-10T18:37:29.120734Z","submitted_at":"2025-06-05T14:16:44Z","title":"Reason-to-Recommend: Using Interaction-of-Thought Reasoning to Enhance LLM Recommendation","version":2},"cited_work":{"arxiv_id":"2506.05069","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05069","snapshot_observed_at":"2026-06-30T21:05:03.746106Z","title":"Reason-to-recommend: Using interaction-of-thought reasoning to enhance llm recommendation","venue":null,"work_id":"6c0f54f6-f9b2-4a07-a9d4-a148e5e3f8a5","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2506.05069","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:95c1f3fe77e4c3367a02ca6d1ceaab14c955d760b6dcb5c232c99a9e94e66173","observation_id":"c4006421-143f-4249-91f7-446dfd205180","resolution":{"observed_at":"2026-05-13T17:28:02.567678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T04:55:59.178101Z","title":null,"venue":null,"work_id":"3624e46b-b8b5-42aa-8a22-e46b7a4f9226","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:80d93fd92f3e3c305abd2501f9f90a0d5cd6e93c01c5d8a8fb1d332dbb047dd6","observation_id":"110de21b-7898-49fc-a074-021d80da7795","resolution":{"observed_at":"2026-05-14T04:56:43.672432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8244d828-c75f-4aae-8c77-4311c24eec7f","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:919b1b3912f3a6f353d99f09b5f7004b3e45a02a757d61ab99f1317eca3c1933","observation_id":"734828b7-084b-453c-8296-568c59153c8a","resolution":{"observed_at":"2026-05-14T04:56:43.686825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"94cd07c0-1b77-4c3d-8674-e5829fdb935c","year":2020},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:a5f8c3c777a2bee8f9b0ffa1769fc1cac4598bcca30cb5a6fced72ca5bba0f66","observation_id":"bade24d0-dd13-460d-bdb9-e6ebbdbc3ffd","resolution":{"observed_at":"2026-05-14T04:56:43.696281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5e0954b5-b693-459d-af28-ea1112bc9a3b","year":2025},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:d86cb0752c13565cfd80bfa04f41b1367b7ab65f56dca74e39474803198f4d21","observation_id":"5a731c13-8716-478f-916c-04025695bcbe","resolution":{"observed_at":"2026-05-14T04:56:43.649242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"45558fcf-ba14-402c-b019-d857c71b6592","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:66071643f5e6fd546e7da05f49e5bc997ee703649cef6a3ba401b9dfed3ff386","observation_id":"742b147e-2e1a-43b2-b6be-ec0df37d51f3","resolution":{"observed_at":"2026-05-14T04:56:43.656379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":18,"verified_fuzzy":1},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2604.03671."}