{"as_of":"2026-08-07T17:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ffe2dac1874bea00bdd9beb6eb541fd11f50be2e6140805f4d18eaedcb3ca9b","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:43:23.733585Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:13:26.701496Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T09:54:34.994786Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-08-03T00:13:26.701496Z","title":"A., Dernoncourt, F., Kveton, B., Wu, J., Yu, T., Song, L., Yang, T., Qin, Y ., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11351","last_updated":"2026-06-28T23:49:44Z","snapshot_observed_at":"2026-08-03T00:13:22.529238Z","submitted_at":"2026-02-11T20:40:43Z","title":"Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T00:13:26.701496Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2602.11351"},"observation_digest":"sha256:a548c666990630c9958e06d0e0178fc4545d406c2a40af6ef45407abf43824e1","observation_id":"bd3124c4-1797-4d42-9b63-7bc0125cb811","resolution":{"observed_at":"2026-08-03T00:13:26.701496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2604.17299","last_updated":"2026-04-21T06:17:50Z","snapshot_observed_at":"2026-07-06T23:04:28.260463Z","submitted_at":"2026-04-19T07:29:37Z","title":"Cat-DPO: Category-Adaptive Safety Alignment","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T05:33:32.642379Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2604.17299"},"observation_digest":"sha256:3052ae75473babe573249ec1a67c9f490c989ec4c8406ef10327210ce24eeec6","observation_id":"84a226cc-6e86-4bcb-af97-65ad555a9fe3","resolution":{"observed_at":"2026-05-10T05:36:01.741205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2604.24977","last_updated":"2026-04-27T20:22:42Z","snapshot_observed_at":"2026-07-06T23:10:57.164248Z","submitted_at":"2026-04-27T20:22:42Z","title":"A Survey on LLM-based Conversational User Simulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T03:21:09.118243Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2604.24977"},"observation_digest":"sha256:ead46371aedcbfb9bb00da86f3def123e3623f12aa99a0908494d473ad87b602","observation_id":"e0113f25-a5ff-4824-a94c-1ed1365b7eda","resolution":{"observed_at":"2026-05-11T22:11:12.091734Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2604.26247","last_updated":"2026-04-29T03:04:43Z","snapshot_observed_at":"2026-07-30T22:46:59.854750Z","submitted_at":"2026-04-29T03:04:43Z","title":"TimeMM: Time-as-Operator Spectral Filtering for Dynamic Multimodal Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T12:54:56.401350Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2604.26247"},"observation_digest":"sha256:ffa672563f3c60f28fd371ce3a22e396ae05150de5a72d630feb5bd90243c5d0","observation_id":"18109681-da7c-4dc8-9741-66ce23d3569d","resolution":{"observed_at":"2026-05-12T09:06:26.182424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2605.12995","last_updated":"2026-05-13T04:52:33Z","snapshot_observed_at":"2026-08-05T19:32:53.214745Z","submitted_at":"2026-05-13T04:52:33Z","title":"F-GRPO: Factorized Group-Relative Policy Optimization for Unified Candidate Generation and Ranking","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-14T19:51:45.657658Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2605.12995"},"observation_digest":"sha256:8919530b2bd9893df2e4b138e8584cb1db77ccfc310191fc83c549ff2432fcb0","observation_id":"7364afbf-13de-463a-8464-87a822720ec4","resolution":{"observed_at":"2026-05-14T19:52:52.347650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2606.28739","last_updated":"2026-06-27T05:26:43Z","snapshot_observed_at":"2026-08-05T17:30:24.601737Z","submitted_at":"2026-06-27T05:26:43Z","title":"Agent Safety Is Action Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T09:50:45.759936Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2606.28739"},"observation_digest":"sha256:c4bb341ec5b58e757063350dfd4d07284e6089f9891730214717e3d67a20b8d6","observation_id":"bfa57893-7f3d-4d52-96d5-3d73151bf6d4","resolution":{"observed_at":"2026-06-30T09:54:34.996301Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-08-02T13:17:09.892437Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20471","last_updated":"2026-05-23T18:16:54Z","snapshot_observed_at":"2026-08-02T13:16:53.329105Z","submitted_at":"2026-05-23T18:16:54Z","title":"Benchmarking the Personalization Capabilities of Large Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T13:17:09.892437Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2607.20471"},"observation_digest":"sha256:661bfab97bbc4aa6f66e65eb39791de94946be3bacf9a8e6c54f3d712050c821","observation_id":"b7a42867-3b8e-4f87-b3a1-afb6ee7d0ab8","resolution":{"observed_at":"2026-08-02T13:17:09.892437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14106/citation-record","integrity":"/paper/2505.14106/integrity","json":"/paper/2505.14106/citation-record.json","paper":"/paper/2505.14106"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.02374","last_updated":"2024-09-25T04:50:38Z","snapshot_observed_at":"2026-07-06T16:27:22.878185Z","submitted_at":"2023-10-03T18:54:10Z","title":"Conversational Health Agents: A Personalized LLM-Powered Agent Framework","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02374","snapshot_observed_at":"2026-08-07T15:43:18.519445Z","title":"Conversational health agents: A personalized llm-powered agent framework.arXiv preprint arXiv:2310.02374, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.519445Z"},"links":{"cited_paper":"/paper/2310.02374","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:9651965bc7112b735bbe57356867a0f36f13386c7c10887afb183a1755a0617f","observation_id":"e9861fdb-99de-45c2-8df0-515c31a77adb","resolution":{"observed_at":"2026-08-07T15:43:18.519445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.970634Z","title":"Persobench: Benchmarking personalized response generation in large language models, 2024","venue":null,"work_id":"98387acb-cf0a-4f8d-a1be-1d1de909783b","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.625291Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:feb6be4225759d255c2610116d19e49b6ef040e0ae02faa42ffafd4ca908c441","observation_id":"e00bf5c9-bc0c-47b8-b2f7-cd2eb10dc9d3","resolution":{"observed_at":"2026-08-07T15:43:35.054834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.853636Z","title":"Claude 3.5 sonnet","venue":null,"work_id":"f3a89ee0-da79-4235-b5e0-3fbdb5a09d26","year":null},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.729628Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:2031e5d71d45a56fc3a051e9a7f9d187008922097f5c270ebe6a0f722eab1707","observation_id":"03167942-a7e7-48c2-bf1e-e6ae533ea020","resolution":{"observed_at":"2026-08-07T15:43:34.909324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13098","last_updated":"2025-08-20T01:59:58Z","snapshot_observed_at":"2026-07-06T19:34:59.826604Z","submitted_at":"2024-10-17T00:04:02Z","title":"A Little Human Data Goes A Long Way","version":3},"cited_work":{"arxiv_id":"2410.13098","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13098","snapshot_observed_at":"2026-08-07T15:43:25.050204Z","title":"A Little Human Data Goes A Long Way","venue":"cs.CL","work_id":"0ae1a525-0d3c-4cb2-b17c-bcb92f477433","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.993776Z"},"links":{"cited_paper":"/paper/2410.13098","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:da47cb1edebacb87a179a8742c888191dd53931baeaaf1606b2c64af52312e69","observation_id":"237bf522-348b-4651-a528-b532151c0119","resolution":{"observed_at":"2026-08-07T15:43:25.276669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02157","last_updated":"2025-05-31T06:33:39Z","snapshot_observed_at":"2026-07-06T20:16:27.318761Z","submitted_at":"2025-01-04T01:46:49Z","title":"Personalized Graph-Based Retrieval for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02157","snapshot_observed_at":"2026-08-07T15:43:19.113061Z","title":"Personalized graph-based retrieval for large language models.arXiv preprint arXiv:2501.02157, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.113061Z"},"links":{"cited_paper":"/paper/2501.02157","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:cdbb8ce43e1a39349d826adc2dfc1e65a87fcf11cd2a1fde96ca27f1c06663e1","observation_id":"c3e01726-ba8e-4cf9-b027-26cfc2176d36","resolution":{"observed_at":"2026-08-07T15:43:19.113061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.244719Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with human judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.244719Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:e276cfa21d3d4cc22ecc9f357f8cf078737b1ae3a473ca7b02a23307658d58d9","observation_id":"03232c27-8236-4033-b7d8-f3d2f54d19af","resolution":{"observed_at":"2026-08-07T15:43:19.244719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14439","last_updated":"2025-04-20T01:16:24Z","snapshot_observed_at":"2026-08-07T16:00:51.819068Z","submitted_at":"2025-04-20T01:16:24Z","title":"LoRe: Personalizing LLMs via Low-Rank Reward Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14439","snapshot_observed_at":"2026-08-07T15:43:19.367275Z","title":"Lore: Personalizing llms via low-rank reward modeling.arXiv preprint arXiv:2504.14439, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.367275Z"},"links":{"cited_paper":"/paper/2504.14439","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:79a1cbdbe995d275daf75011cd630da842bb2552c5cbcb204c2706e12f4cbf14","observation_id":"a903f797-26e0-48dc-b27f-1e35298c32d9","resolution":{"observed_at":"2026-08-07T15:43:19.367275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.374501Z","title":"Optimal classifier for imbalanced data using matthews correlation coefficient metric.PloS one, 12(6):e0177678, 2017","venue":null,"work_id":"a07af7bd-b88e-47ff-bb89-a15f4c6973ff","year":2017},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.513223Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:c73d21bdaa5e66c4a8b10e5626bad65b89926e46c46699adc4cd17ee93ca2e83","observation_id":"a8722fdf-21c2-468e-b36a-a02ebb7c345c","resolution":{"observed_at":"2026-08-07T15:43:34.490084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.163786Z","title":"Beyond prompts: Dy- namic conversational benchmarking of large language models","venue":null,"work_id":"06bafede-54a0-43f1-afb9-db77e1998b6d","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.655393Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:8666b7edd820c1106ff565de682f46501e1597635b7b2e01c28fceac9f8f3f23","observation_id":"74b080f6-b2ed-42c0-a046-72636d8e93b4","resolution":{"observed_at":"2026-08-07T15:43:34.268054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.037013Z","title":"Root mean square error (rmse) or mean absolute error (mae).Geoscientific model development discussions, 7(1):1525–1534, 2014","venue":null,"work_id":"9491670d-cc52-4841-89a7-85604ea46eea","year":2014},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.807578Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:21b57eaa6ca0c5988f3d9b4660d890650850311cd9e0d57f90673c4b82b9cfaa","observation_id":"f3e6934d-15cb-4155-9c60-ad8fd8a2b49f","resolution":{"observed_at":"2026-08-07T15:43:34.075713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.894818Z","title":"When large language models meet personalization: Perspectives of challenges and opportunities.World Wide Web, 27(4):42, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.894818Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:e83a234c9577aa5274a2ce1becbb19842e572e450bc374ff36253d47b49bfad7","observation_id":"2ef064e0-e58f-4565-9410-fc52a2f1045c","resolution":{"observed_at":"2026-08-07T15:43:19.894818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18792","last_updated":"2025-06-01T02:21:49Z","snapshot_observed_at":"2026-08-07T16:40:51.803897Z","submitted_at":"2025-03-24T15:39:25Z","title":"REALM: A Dataset of Real-World LLM Use Cases","version":2},"cited_work":{"arxiv_id":"2503.18792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18792","snapshot_observed_at":"2026-08-07T15:43:24.714360Z","title":"REALM: A Dataset of Real-World LLM Use Cases","venue":"cs.HC","work_id":"cd4b7a0e-78ad-400f-b87f-35295911301b","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.033370Z"},"links":{"cited_paper":"/paper/2503.18792","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:23e813092bb7641dc4b955599ea7691d9e84e3e89629209070b2df278b3433b4","observation_id":"3cc7d673-0b61-4547-aa25-30019abbd5a8","resolution":{"observed_at":"2026-08-07T15:43:24.811302Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.840320Z","title":"The advantages of the matthews correlation coefficient (mcc) over f1 score and accuracy in binary classification evaluation.BMC genomics, 21:1–13, 2020","venue":null,"work_id":"630a9c18-e5c4-46a1-aad9-ee318520cc70","year":2020},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.144923Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:bfbff71ba6969de39d404c5a9b72b4ede2ebc50927061fec47a5937399902dad","observation_id":"4e070871-557d-43a0-adea-d59997ee4ab3","resolution":{"observed_at":"2026-08-07T15:43:33.909265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.694875Z","title":"The matthews correlation coefficient (mcc) is more informative than cohen’s kappa and brier score in binary classification assessment","venue":null,"work_id":"1f1c8f5d-1996-4d9e-b620-61b5a600e809","year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.324986Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:4fd21e7a5b5779617e2e3d2b7deca3aa42eb091d6029d3f4ad25267e9ef1dd2a","observation_id":"b06db013-27d0-4816-9cb6-68ce7003e4d0","resolution":{"observed_at":"2026-08-07T15:43:33.761772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.501745Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":"48788f1e-fe12-4087-9e51-798b7636b4ba","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.465431Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:b448265ec962ee2588e6a934356578e2445ff6ab06bc0f43a651527b50b636dd","observation_id":"88126155-e729-4f8f-8fc5-f140559fa286","resolution":{"observed_at":"2026-08-07T15:43:33.595175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11431","last_updated":"2021-11-22T18:59:34Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:34Z","title":"RedCaps: web-curated image-text data created by the people, for the people","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11431","snapshot_observed_at":"2026-08-07T15:43:20.580260Z","title":"Redcaps: Web-curated image-text data created by the people, for the people.arXiv preprint arXiv:2111.11431, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.580260Z"},"links":{"cited_paper":"/paper/2111.11431","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:44606bb8d84a3b503b6477199e50c7bf903a3f50ad816565e727e6ef55f95fd9","observation_id":"c48a18f2-6a9e-40d5-b11d-dd9a31c50a36","resolution":{"observed_at":"2026-08-07T15:43:20.580260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:20.662819Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.662819Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:4833a023471a84ae9b4895fd2a489dd2ee133fcc9212e148c67197a896ea8d65","observation_id":"9a06c4d6-7fac-4a12-a0aa-9fc9e604ac27","resolution":{"observed_at":"2026-08-07T15:43:20.662819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05664","last_updated":"2022-01-25T14:25:42Z","snapshot_observed_at":"2026-07-06T11:17:55.927608Z","submitted_at":"2021-06-10T11:27:47Z","title":"Ruddit: Norms of Offensiveness for English Reddit Comments","version":3},"cited_work":{"arxiv_id":"2106.05664","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.05664","snapshot_observed_at":"2026-08-07T15:43:24.381644Z","title":"Ruddit: Norms of Offensiveness for English Reddit Comments","venue":"cs.CL","work_id":"f25e3287-2148-4841-9f3c-ee29076350d2","year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.731343Z"},"links":{"cited_paper":"/paper/2106.05664","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:dcf59fdee33826d05df9063f1f16b9e38a9f3852c432ae78e023c41901789976","observation_id":"850ceb35-110c-4dc9-9b9a-a27a373e84d2","resolution":{"observed_at":"2026-08-07T15:43:24.552148Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.299446Z","title":"Root mean square error (rmse) or mean absolute error (mae): When to use them or not.Geoscientific Model Development Discussions, 2022:1–10, 2022","venue":null,"work_id":"f2edf890-0336-47fd-930e-6f3e5f7edfb1","year":2022},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.867591Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:306eb35a321c5edb6c037302a124a9737fc3f0b6d1aa940b59dca7d84bb89add","observation_id":"194d8e5f-4214-4e7e-bfc7-0a4e1ee518eb","resolution":{"observed_at":"2026-08-07T15:43:33.382963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.053190Z","title":"Rossi, Franck Dernoncourt, Hanieh Deilamsalehy, Xiang Chen, Ruiyi Zhang, Shubham Agarwal, Nedim Lipka, Chien Van Nguyen, Thien Huu Nguyen, and Hamed Zamani","venue":null,"work_id":"8bad4310-e576-4005-928b-e8ac213acaf3","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.984363Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:e56ca3d06648fee3f0c710c1db0b15c651378b7e23a65d5cb58698c110e34086","observation_id":"e4f4b3bd-d184-45bd-9946-d970bf281d4c","resolution":{"observed_at":"2026-08-07T15:43:33.165335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.783249Z","title":"Mt-eval: A multi-turn capabilities evaluation benchmark for large language models, 2024","venue":null,"work_id":"7a52fe2e-5c5e-4fbd-8158-42d46be81aa6","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.117526Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:792733cbf79ac867aa18b62b2a851e487e2bcb1aec7f84a86fc3b6d4674b37ca","observation_id":"570f0968-3ae8-4466-8fbe-45f11d61adc4","resolution":{"observed_at":"2026-08-07T15:43:32.936888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.556378Z","title":"A framework for building adaptive intelligent virtual assistants","venue":null,"work_id":"3e8b8e55-bc28-49fe-b5ee-e45a483c951a","year":2014},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.243210Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:a0acfe5d129ca462e08d8e198b2fde9f570d3bd589e3d7b3e2e02d0aca33c457","observation_id":"b6daae78-9455-4ebb-ac01-1c48db55eb46","resolution":{"observed_at":"2026-08-07T15:43:32.672196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07968","last_updated":"2023-08-15T18:06:23Z","snapshot_observed_at":"2026-08-03T15:59:42.686889Z","submitted_at":"2023-08-15T18:06:23Z","title":"Teach LLMs to Personalize -- An Approach inspired by Writing Education","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07968","snapshot_observed_at":"2026-08-07T15:43:21.349336Z","title":"Teach llms to personalize–an approach inspired by writing education","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.349336Z"},"links":{"cited_paper":"/paper/2308.07968","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:72a1d0ac26bc5093c58dd527a0b366f41be426bc6f34e184ce15f956cc907837","observation_id":"77ecc1ea-0684-4054-b46c-9b666cf43b3c","resolution":{"observed_at":"2026-08-07T15:43:21.349336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.353520Z","title":"Panoptic scene graph generation with semantics-prototype learning.Proceedings of the AAAI Conference on Artificial Intelligence, 38(4):3145–3153, Mar","venue":null,"work_id":"d1834181-2410-44c3-9537-49883fe17556","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.487031Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:16cc3691509b498af0fe03c6a3c9af53ab2f0d378f1623823a806b9e51451c03","observation_id":"1945642b-fd5f-49bf-a9bd-77d49420dab2","resolution":{"observed_at":"2026-08-07T15:43:32.437751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.122265Z","title":"Artificial intelligence in intelligent tutor- ing systems toward sustainable education: a systematic review.Smart Learning Environments, 10(1):41, 2023","venue":null,"work_id":"5f77079c-2170-42b1-a287-cc420060a954","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.584797Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:376c58d4c56ca0834a9080553dd0a27cddff1e60bdd3e85abc5b27b2a0e26936","observation_id":"62133eab-494d-409c-9d3b-59c8a7b733aa","resolution":{"observed_at":"2026-08-07T15:43:32.240242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:21.651056Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.651056Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:18d1a2a7c32fe5991f413bdd042c405f58c979bd885dea11f621635c7473e100","observation_id":"955fdb45-569b-4517-b7be-6a5169debecc","resolution":{"observed_at":"2026-08-07T15:43:21.651056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.902701Z","title":"Persona-sq: A personalized suggested question generation framework for real-world documents, 2024","venue":null,"work_id":"4b10660b-b50e-4b80-a9f5-9a594bee6f62","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.760648Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:f41b17d0d1a0baa44619b469b0c7e6285bef7a9d8764a96b63b47a45858e3c17","observation_id":"646fc09e-b860-47e2-a683-92459fac4bb5","resolution":{"observed_at":"2026-08-07T15:43:31.971000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.748810Z","title":"Soda-eval: Open-domain dialogue evaluation in the age of llms, 2024","venue":null,"work_id":"a3bb60a4-334c-491c-be0d-dad640383b3f","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.906459Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:c1c6045b191a360a80ea92ef5043f4e1c9edb5621b9d28cc1c19f423b560d832","observation_id":"9533affa-216e-4632-8ac6-64befd694cc9","resolution":{"observed_at":"2026-08-07T15:43:31.829533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.583833Z","title":"Gpt-4o mini: advancing cost-efficient intelligence","venue":null,"work_id":"44409d9e-8870-4d9e-a534-62ceb4fd3148","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.975869Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:5d9dcdd9674debcb7f6b2fcad129f5c6b51d0badc1a3f91bdcf5a5ad1181870a","observation_id":"a054c5ee-571e-44a1-bd79-40f20b53da15","resolution":{"observed_at":"2026-08-07T15:43:31.643229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.383539Z","title":"Introducing gpt-4.1 in the api","venue":null,"work_id":"da882a89-cccd-44c0-b546-0dc4ba952db8","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.043964Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:9166d45b4b14eeb132409097058171cf67b023f79950b647e24a40e9380fad39","observation_id":"6ac76a55-64bc-42c0-96ca-c0cfd0f0339c","resolution":{"observed_at":"2026-08-07T15:43:31.480886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.172514Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.172514Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:faa5dcd9fab322fdaf3960421479a71554082fa80313f68deb7b83e88e337375","observation_id":"9d69a277-3a48-4798-855c-a90eab1feb4e","resolution":{"observed_at":"2026-08-07T15:43:22.172514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.142986Z","title":null,"venue":null,"work_id":"ea79e02b-c664-483f-bae2-34112022af53","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.264169Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:be1e833d99ed7a26cd46dc8e260c6d592157256b07184bf830f42cca432d4255","observation_id":"65e016f6-564b-4426-8085-d6a390ff8535","resolution":{"observed_at":"2026-08-07T15:43:31.250804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.895312Z","title":null,"venue":null,"work_id":"534f6126-2ffb-4538-b2e3-3e528c3374d1","year":2020},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.394518Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:c4ba56acd0945e7b1c94e8346378c70488b6d39cf2542951329f2b932186f645","observation_id":"0fed4877-ccbd-4a02-9aee-37490e77aec9","resolution":{"observed_at":"2026-08-07T15:43:30.988064Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.486570Z","title":"Sentence-bert: Sentence embeddings using siamese bert- networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.486570Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:1b55370a149d8d714dc47d7f5e329d687e97036f1172178da78577d1a0268d80","observation_id":"e44488dd-ecf2-4aaa-83fb-0f4bdac730a5","resolution":{"observed_at":"2026-08-07T15:43:22.486570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.726359Z","title":"Lamp: When large language models meet personalization, 2024","venue":null,"work_id":"a21de298-4990-4bd5-94ad-1ad561b8c9b6","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.581458Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:3d72812d2cb882859880a75ab38a77fb951d231370fce521eaa4aa2e81bb12aa","observation_id":"e08ac11f-6f2a-4ef2-bcd4-b722c05ab059","resolution":{"observed_at":"2026-08-07T15:43:30.780537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.649086Z","title":"Ai models collapse when trained on recursively generated data.Nature, 631(8022):755– 759, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.649086Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:cd58a162f45f70782edb92a22b9e4ee27e6a791341ab4efc2ed6177a77950400","observation_id":"639f9236-0fca-4285-9c56-1765c052d4e5","resolution":{"observed_at":"2026-08-07T15:43:22.649086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.514740Z","title":"Democra- tizing large language models via personalized parameter-efficient fine-tuning","venue":null,"work_id":"af83564c-900a-406b-b0df-ac6a6383992f","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.762396Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:39c7684b5f87919fbffb9a211de71e13d111af9f08e708aedb86a690bdfff79b","observation_id":"dbf2d392-76b7-4210-bacf-45ab18e9a5db","resolution":{"observed_at":"2026-08-07T15:43:30.623584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.335216Z","title":"An ai-based decision support system for predicting mental health disorders.Information Systems Frontiers, 25(3):1261–1276, 2023","venue":null,"work_id":"8601aedb-ff0d-45de-a411-af2c96d7a61f","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.887964Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7e966c44655ca513bd9bef897cd04b908381ce857d6a62da7469ca7d9caecb61","observation_id":"2d87413e-c6d6-43ab-9c83-59a6cddc2c4e","resolution":{"observed_at":"2026-08-07T15:43:30.404821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.943347Z","title":"Position: Will we run out of data? limits of llm scaling based on human-generated data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.943347Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:26dc892f2906ef18562086950f3123d88da485ada9d0176e9f89db253d8e1483","observation_id":"6b15c0d2-b97b-46a3-abd4-7495a23729a5","resolution":{"observed_at":"2026-08-07T15:43:22.943347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02142","last_updated":"2024-12-03T03:59:03Z","snapshot_observed_at":"2026-07-06T20:00:41.813099Z","submitted_at":"2024-12-03T03:59:03Z","title":"Personalized Multimodal Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02142","snapshot_observed_at":"2026-08-07T15:43:23.001354Z","title":"Personalized multimodal large language models: A survey.arXiv preprint arXiv:2412.02142, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.001354Z"},"links":{"cited_paper":"/paper/2412.02142","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:3df9d18673fd7d60929f624646709bef663e57f9125665ef6f5af8a2a5f5fbce","observation_id":"2d03cefe-d484-4bf3-8557-0007abc5c064","resolution":{"observed_at":"2026-08-07T15:43:23.001354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18013","last_updated":"2025-08-15T03:28:39Z","snapshot_observed_at":"2026-08-04T11:22:48.683493Z","submitted_at":"2024-02-28T03:16:44Z","title":"A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18013","snapshot_observed_at":"2026-08-07T15:43:23.118282Z","title":"A survey on recent advances in llm-based multi-turn dialogue systems.arXiv preprint arXiv:2402.18013, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.118282Z"},"links":{"cited_paper":"/paper/2402.18013","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7daede8aa4260af6b6b2d2903dda9e6a3f217d80cc5753f7bf40d3619bb62616","observation_id":"0c64fbc1-cfc5-4224-ba00-99c35c647e1c","resolution":{"observed_at":"2026-08-07T15:43:23.118282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:27.053843Z","title":"xdial-eval: A multilingual open-domain dialogue evaluation benchmark","venue":null,"work_id":"93bf4352-1104-4f98-8b98-624cd4520ff8","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.196806Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:a607b1bd80ec4a96d6d5179f3a85f5d5e5818c0d411dc04444a410e4df399f3b","observation_id":"f5e06eb9-0d06-48ae-bf85-deb4ba1386b5","resolution":{"observed_at":"2026-08-07T15:43:30.185319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.855441Z","title":null,"venue":null,"work_id":"799782dd-e60e-4d44-9fe7-d1443fe49de4","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.314664Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:b3712af02c727ac36bcc0b2e9ba886490345cec012258188c0ac919f65918e43","observation_id":"ca8f1e77-8842-440d-a565-21323465c189","resolution":{"observed_at":"2026-08-07T15:43:25.986776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00027","last_updated":"2025-07-13T02:13:14Z","snapshot_observed_at":"2026-07-06T19:43:09.889618Z","submitted_at":"2024-10-29T04:01:11Z","title":"Personalization of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00027","snapshot_observed_at":"2026-08-07T15:43:23.443293Z","title":"Personalization of large language models: A survey.arXiv preprint arXiv:2411.00027, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.443293Z"},"links":{"cited_paper":"/paper/2411.00027","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:94ebdfe006c24e2de3c9eab4bae2f70b2e7f630f2ff413b71950a3981944faaf","observation_id":"e23151f7-29ff-40fe-9dbb-d849f8ae67e2","resolution":{"observed_at":"2026-08-07T15:43:23.443293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.627736Z","title":"DiQAD: A benchmark dataset for open-domain dialogue quality assessment","venue":null,"work_id":"5c0672d7-22c7-48ba-a750-85bc1b910789","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.527996Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:072488dd4a69181270ca9245b2de87c004fc7c374d241a391d400b76105d8e21","observation_id":"a9e526ef-fff8-4464-832b-32f5844900cb","resolution":{"observed_at":"2026-08-07T15:43:25.739429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.470253Z","title":"Zollo, Andrew Wei Tung Siah, Naimeng Ye, Ang Li, and Hongseok Namkoong","venue":null,"work_id":"4d77e4c7-f48c-4743-a1e0-2dc662ee21c1","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.662353Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:56e4ca2679c66a5f179c81c962c20e13ea926684e2409fdf66039e62e3182a7e","observation_id":"791e650c-e121-426e-87d2-3373f14446e5","resolution":{"observed_at":"2026-08-07T15:43:25.537365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8620.9109","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:23.946434Z","title":"Best Response","venue":null,"work_id":"c1779647-88a7-4285-97a7-bad2ce372728","year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.733585Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:bc167206804f54622a7be75f856a4de77b8361bc5c3430ed55afa424c5c611e0","observation_id":"7c921583-99e9-4d70-8560-649b95daa7cc","resolution":{"observed_at":"2026-08-07T15:43:24.106045Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.623036Z","title":null,"venue":null,"work_id":"6f8fc73f-d93c-4572-bb85-6a12b7885769","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.862204Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:13bebb5437cc03dcd2a1359cc7a4601eb6cc82672e5f468dab3785e38941accf","observation_id":"3c5c23a3-3e7f-4e88-9235-16ffc7f9185b","resolution":{"observed_at":"2026-08-07T15:43:34.736747Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:37:49.237460Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":19,"verified_exact":3,"verified_fuzzy":24},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 7 inbound Pith citation observations for arXiv:2505.14106."}