{"as_of":"2026-08-06T16:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60d8e17c304bb80582c2a3ecc6df9193bb59a37a01c47c868d49dee4875ccff5","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T15:31:25.079191Z","state":"measured"},{"denominator":97,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":97,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.17079/citation-record","integrity":"/paper/2605.17079/integrity","json":"/paper/2605.17079/citation-record.json","paper":"/paper/2605.17079"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.04204","last_updated":"2024-04-05T16:29:58Z","snapshot_observed_at":"2026-07-06T17:56:10.403147Z","submitted_at":"2024-04-05T16:29:58Z","title":"Social Skill Training with Large Language Models","version":1},"cited_work":{"arxiv_id":"2404.04204","doi":"10.48550/arxiv.2404.04204","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.04204","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Social skill training with large language models","venue":"arXiv (Cornell University)","work_id":"a5697ee1-9b2d-4443-84c0-5ca82c080b0a","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2404.04204","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:6dcf21991acd1b19e09930cd5a3ba37bdb0804a9fd1064384dfad1645374f6b1","observation_id":"c01e7bc0-e8b3-455e-9f03-15912fb9bb68","resolution":{"observed_at":"2026-05-20T15:33:25.505709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08691","last_updated":"2026-04-10T15:11:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-12T15:27:07Z","title":"AgentSociety: Large-Scale Simulation of LLM-Driven Generative Agents Advances Understanding of Human Behaviors and Society","version":2},"cited_work":{"arxiv_id":"2502.08691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.08691","snapshot_observed_at":"2026-07-08T17:35:09.833227Z","title":"AgentSociety: Large-Scale Simulation of LLM-Driven Generative Agents Advances Understanding of Human Behaviors and Society","venue":"cs.SI","work_id":"293ae4a1-dd38-4778-93be-14914c1f0643","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2502.08691","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:7e8ba2f130ad7b059fcf569f7bdef890b7b6014c93c30d6c851d450eab407209","observation_id":"37ab29bd-9789-4aef-acda-bdbd30d454ae","resolution":{"observed_at":"2026-05-20T15:33:25.466243Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trendsim: Simulating trending topics in social media under poisoning attacks with llm-based multi-agent system","venue":null,"work_id":"497d8cd2-7198-461f-b248-9658dc85a5f4","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:7989182d561469ae1eb7039913a34a9dbcf375a70f8b2fc59537430b5c4f06be","observation_id":"a826ecc9-96ad-4843-86cc-7c9db0a0e154","resolution":{"observed_at":"2026-05-20T15:33:25.877913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"User behavior simulation with large language model-based agents.ACM Transactions on Information Systems, 43(2):1–37","venue":null,"work_id":"f202380a-62d9-4f49-8ef7-d561c28f2c5a","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:82023c0947e759aeaaf190c21d24cf7270f09234b9c6a3cb85ce7ac03514c6dd","observation_id":"71595ced-b51e-45ce-be15-a5d4eb251d4d","resolution":{"observed_at":"2026-05-20T15:33:25.881977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm-based multi-agent system for simulating and analyzing marketing and consumer behavior","venue":null,"work_id":"16bf9fd1-3bf8-4149-abb5-d7987f66a8e6","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:aeba2d04bd7aa63fbe2f39d950bc8a0c30b71b879e9625ec6f04863b3d733ece","observation_id":"8936240e-e6b2-43bf-a39d-e4a552b6309c","resolution":{"observed_at":"2026-05-20T15:33:25.832395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03563","last_updated":"2024-12-04T18:56:37Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:56:37Z","title":"From Individual to Society: A Survey on Social Simulation Driven by Large Language Model-based Agents","version":1},"cited_work":{"arxiv_id":"2412.03563","doi":"10.48550/arxiv.2412.03563","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03563","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"From individual to society: A survey on social simulation driven by large language model-based agents","venue":null,"work_id":"9ce35c8b-0225-4970-ae4e-60762d97e3f2","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2412.03563","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:8a25907ae7ae3289935d661dd4019b4cbd66e836a4b29f6c0fdbde07dabe04fa","observation_id":"71c724c9-c2d5-4352-a5d8-1cfd0fd82c05","resolution":{"observed_at":"2026-05-20T15:33:25.478906Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Performance and biases of large language models in public opinion simulation.Humanities and Social Sciences Communications, 11(1):1–13","venue":null,"work_id":"6e3fd34b-e164-4313-a0d9-192f24daebf4","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:ead214f9544fa54534e5d9f32efdb043cabfbfcf783bbadcbbe1af4a21e6ba62","observation_id":"795fa78a-53ca-4faa-84e0-20b63f7a7cf7","resolution":{"observed_at":"2026-05-20T15:33:25.874078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08579","last_updated":"2026-07-06T04:12:55Z","snapshot_observed_at":"2026-07-09T23:17:36.834612Z","submitted_at":"2025-01-15T04:59:49Z","title":"LLM-based Human Simulations Have Not Yet Been Reliable","version":3},"cited_work":{"arxiv_id":"2501.08579","doi":"10.48550/arxiv.2501.08579","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08579","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm-based human simulations have not yet been reliable","venue":"ArXiv.org","work_id":"2dce7b7d-95a8-4ec4-80e1-089665e62a9f","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2501.08579","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:3a8cf30db954cd215cb3f885a71a71083410fc7c6121e173558f903e620476a6","observation_id":"39729a45-696b-44f3-b706-f41eef5f010d","resolution":{"observed_at":"2026-07-07T03:18:07.787194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Theory of mind in large language models: Assessment and enhancement","venue":null,"work_id":"d254b7a9-5d02-476c-97c3-870071204e04","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:d7c70ecc5c29c8d66e4e7c8a1f15fcd56d3fc4c782f472daf8ced531096e4137","observation_id":"3474ac14-f526-4a52-a4ae-23d4a46b994f","resolution":{"observed_at":"2026-05-20T15:33:25.858285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recusersim: A realistic and diverse user simulator for evaluating conversational recommender systems","venue":null,"work_id":"4bd4a27a-2842-4833-9fd3-17428d03a7d3","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:d37f9b92433db5b52651ed8abfa9bbd00efbf1a26abd8b72f9118972c5d5576e","observation_id":"a2ec728a-189f-4b57-bd95-f6211c1108c7","resolution":{"observed_at":"2026-05-20T15:33:25.824710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.08338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T09:54:35.007307Z","title":"Llms reproduce human purchase intent via semantic similarity elicitation of likert ratings","venue":null,"work_id":"52a04c76-0b43-4707-bd96-22bb786994e1","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:6c83b02c7d85e77c8d7f05dde680829bb5baf9494859db355641954a158f1f83","observation_id":"f4d5b36b-6722-4653-914b-45fe3370781f","resolution":{"observed_at":"2026-05-20T15:33:25.425726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simulating public opinion: Comparing distributional and individual-level predictions from llms and random forests.Entropy, 27(9):923","venue":null,"work_id":"4f9830d7-eec1-4c5d-b4d3-eb4831c9b5c3","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:afab6697dd17db07e41243cbea8b945f008d81d1b4a95c7b2ff1eb3bd0a9888e","observation_id":"38a18771-a4e5-43d6-b053-b98381ad76b0","resolution":{"observed_at":"2026-05-20T15:33:25.845184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19787","last_updated":"2026-03-31T19:27:59Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-31T19:27:59Z","title":"LLM Agents Predict Social Media Reactions but Do Not Outperform Text Classifiers: Benchmarking Simulation Accuracy Using 120K+ Personas of 1511 Humans","version":1},"cited_work":{"arxiv_id":"2604.19787","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19787","snapshot_observed_at":"2026-07-08T19:35:32.845577Z","title":"LLM Agents Predict Social Media Reactions but Do Not Outperform Text Classifiers: Benchmarking Simulation Accuracy Using 120K+ Personas of 1511 Humans","venue":"cs.CL","work_id":"64ee01f1-6f68-4e5f-8e75-9fccc1268b5b","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2604.19787","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a6841d3e2d7847e0cfbe8a5fad56d6a995808eb6ba32b4abf8fea71cc2140020","observation_id":"1fc70ad9-be0f-48ac-969f-79ac495623ac","resolution":{"observed_at":"2026-05-20T15:33:25.540041Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards simulating social media users with llms: Evaluating the operational validity of conditioned comment prediction","venue":null,"work_id":"c8b5ec2d-da64-4713-b2a2-e6a41b9d740c","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:267dc8d6977805c8fdc90ab38baeb3ff7d0438ee194532c57163885655433c4c","observation_id":"178b2804-16cb-42be-aa98-a7db25c0d6fa","resolution":{"observed_at":"2026-05-20T15:33:25.927899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smp challenge: An overview and analysis of social media prediction challenge","venue":null,"work_id":"b699749c-6fc1-4bf5-ac03-207283a11079","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:117ad31c3ba1f64c163812d999d8ce40d9a54887f81b0cce59a3de1b53120eca","observation_id":"49d33115-04b2-4354-9965-8dfcc1300047","resolution":{"observed_at":"2026-05-20T15:33:25.932210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17516","last_updated":"2026-04-13T07:04:29Z","snapshot_observed_at":"2026-07-06T22:33:34.164422Z","submitted_at":"2025-10-20T13:14:38Z","title":"SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors","version":4},"cited_work":{"arxiv_id":"2510.17516","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.17516","snapshot_observed_at":"2026-07-05T10:50:57.565385Z","title":"SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors","venue":"cs.CL","work_id":"fc89fa8e-4064-4370-a681-d6d388f74b77","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2510.17516","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:ec0776f30b1336086bdff67f078464a94d8f5e60d7ea542715db16d8f6f6ca2f","observation_id":"cd1abd17-5196-419b-bcc1-9e5e2f16d4a1","resolution":{"observed_at":"2026-05-20T15:33:25.531041Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Charactereval: A chinese benchmark for role-playing conversational agent evaluation","venue":null,"work_id":"68c2d5bf-f0ca-4f00-a038-bf4827aab119","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:f24e2ec1a1dae539c3a87a66420614670dc8c20321d2fb79d77cd3a9148e0acd","observation_id":"068be4a2-5e0b-4f45-97e7-9fe897de3428","resolution":{"observed_at":"2026-05-20T15:33:25.908476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roleagent: Building, interacting, and benchmarking high-quality role-playing agents from scripts.Advances in Neural Information Processing Systems, 37:49403–49428","venue":null,"work_id":"f6dd867f-b1ac-464e-b252-ff1467d8c03b","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:bc0a8a6b493b1e8d0d692d8de3b8319c383d808dcc710df2298929573a3a4185","observation_id":"3a016d27-9765-4e04-bb08-d2bd95cb4dcb","resolution":{"observed_at":"2026-05-20T15:33:25.919655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":"2411.15594","doi":"10.1016/j.xinn.2025.101253","metadata_source":"pith","pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on LLM-as-a-Judge","venue":"cs.CL","work_id":"2676656a-67bd-4ad5-bad6-cb6f5fcdbfbe","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:b61697fcc0be58f9899f1a12ad244f1d4ed4cb855949855ecc783c87a29d4f30","observation_id":"ab4846b8-f80d-4827-ad06-5e72f93461f1","resolution":{"observed_at":"2026-05-20T15:33:25.536603Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Humans or LLMs as the judge? a study on judgement bias","venue":null,"work_id":"77791d05-d483-4486-8e7d-c3343ca50f51","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:ce373391b2f31ce8a83fbdac6283df81ae8dbb9cb3e380e4cdcef7d9ef201bec","observation_id":"6ff4e135-e758-499d-b16a-62bad03ddb6d","resolution":{"observed_at":"2026-05-20T15:33:25.897068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:25.345368Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark.Advances in Neural Information Processing Systems, 37:95266–95290","venue":null,"work_id":"8ce2e771-bc8c-4b3b-a834-6303b981b746","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:b785a9bd9cfe8c1a6693e9539c991d1278fc9b2c20f275d7b267ec84919ed22e","observation_id":"6c54b21c-718e-4c0d-aae6-8ae3e665491d","resolution":{"observed_at":"2026-05-20T15:33:25.899622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:55200a77a145f80444e1b207ddc61f27d5fd0135d4e623889f991db4f2e53037","observation_id":"b2adfedd-5309-4552-a679-72f318d8a7ed","resolution":{"observed_at":"2026-05-20T15:33:25.527940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":"2601.11868","doi":"10.48550/arxiv.2302.01973","metadata_source":"pith","pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","venue":"cs.SE","work_id":"0624be05-1d97-4fd6-8300-b04b8a3ab04b","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:725df3d315779c4111a1e8326a5ebb9b11531b0fe601485acb8cf72db81d4b04","observation_id":"715c29b0-5284-465f-88ec-2763e48ffdd8","resolution":{"observed_at":"2026-05-20T15:33:25.519246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fantom: A benchmark for stress-testing machine theory of mind in interactions","venue":null,"work_id":"1247d42c-b8f4-411e-a8ec-8d0dcd58fb63","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:f90c6a0ca3270c1655107a20d0818f03876affeb4bba40492521550989934608","observation_id":"47588c25-c158-481c-8111-8af767a24f72","resolution":{"observed_at":"2026-05-20T15:33:25.905972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Opentom: A comprehensive benchmark for evaluating theory-of-mind reasoning capabilities of large language models","venue":null,"work_id":"63d297b4-e263-4122-9b76-37c0b29170f1","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:98cb21a110dbbaeba67002072b7bd925b2b3bb5b1028ac0c6d98ec931a61efea","observation_id":"7829a499-67d9-47d3-879e-bab3a4582435","resolution":{"observed_at":"2026-05-20T15:33:25.923864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O’Brien, Carrie J","venue":null,"work_id":"46d78804-45e1-4b95-be3d-499a4746e526","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:782ae995f7704fa934e2a1d086b6dff621c903bf0457b629f837ca3cbe46de2d","observation_id":"0bf46556-9f86-4050-a148-28be1118dc92","resolution":{"observed_at":"2026-05-20T15:33:25.879801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Arriaga, and Adam Tauman Kalai","venue":null,"work_id":"9d74a672-8032-48a0-96e5-88bc292e6918","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:eb86cd0914954fef2851294f2282ad5bcdd5bfae083146165b506b444ce72ee0","observation_id":"6762a6f3-1f8c-4049-9377-a31d093700b8","resolution":{"observed_at":"2026-05-20T15:33:25.884104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models as psychological simulators: A methodological guide","venue":null,"work_id":"b673238d-788d-4cea-aafd-4a895529020d","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:edde0cbee3e40457aff68effea771fb8a742c1de1f6c6ee7179ab06551b69560","observation_id":"982e131c-ae28-4476-87a3-27feb3bcb765","resolution":{"observed_at":"2026-05-20T15:33:25.872010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21587","last_updated":"2025-09-12T20:18:27Z","snapshot_observed_at":"2026-08-04T14:30:21.370286Z","submitted_at":"2025-06-17T19:19:14Z","title":"A Cross-Cultural Comparison of LLM-based Public Opinion Simulation: Evaluating Chinese and U.S. Models on Diverse Societies","version":2},"cited_work":{"arxiv_id":"2506.21587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.21587","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A cross-cultural comparison of llm-based public opinion simulation: Evaluating chinese and us models on diverse societies","venue":null,"work_id":"9d04c179-091b-449e-b3ea-3372015300b0","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2506.21587","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:f7febafd6d8b8f46a5394f7f2e3f857f33806afef2c23310be7ecfa7f221049d","observation_id":"6a73177f-b558-4b3c-a368-34c8fef5fde5","resolution":{"observed_at":"2026-05-20T15:33:25.445659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extracting consumer insight from text: A large language model approach to emotion and evaluation measurement","venue":null,"work_id":"6bb43ff3-cd33-4d0e-90f6-4ad383507c76","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:f8a73f580df7e2d657f59b1a5de1eafaba64b798749b5a1fe8e24466875690c6","observation_id":"d9866878-64d7-42f9-a98b-123bfdc6653d","resolution":{"observed_at":"2026-05-20T15:33:25.435018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models for market research: A data-augmentation approach.Marketing Science","venue":null,"work_id":"44286464-0615-441d-befc-63d548dcb137","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:8ae9ebc42794d94dcc920caecd10f9bfc33365cb028451ca7c752b27ae37177a","observation_id":"660293aa-6527-4527-a5f3-b595b808e5a2","resolution":{"observed_at":"2026-05-20T15:33:25.886232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T07:53:27.095265Z","title":"Predicting results of social science experiments using large language models.Preprint","venue":null,"work_id":"aca8e073-01f4-4419-a0b3-c2bd240224ae","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:1d6f8801a66b8c773e0fccba4749d0680fe833e3881f1a10bf12559ea0c8515b","observation_id":"5b1ea826-bbf0-4d1b-a170-c48402c9596c","resolution":{"observed_at":"2026-05-20T15:33:25.854088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02234","last_updated":"2025-06-05T15:12:55Z","snapshot_observed_at":"2026-07-06T21:03:26.104352Z","submitted_at":"2025-04-03T03:01:26Z","title":"LLM Social Simulations Are a Promising Research Method","version":2},"cited_work":{"arxiv_id":"2504.02234","doi":"10.48550/arxiv.2504.02234","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.02234","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R., Liu, R., Richardson, S","venue":"ArXiv.org","work_id":"9e9c31eb-56ec-4efe-b587-4ee3e9c22a53","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2504.02234","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a9bbac568dafd66e0cded172b4954709e22b01a991e0eaaf4e1c8e8e4f848470","observation_id":"b8046455-6f75-4c2c-b3a0-c031bd5c9153","resolution":{"observed_at":"2026-05-20T15:33:25.450992Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16772","last_updated":"2025-08-04T01:03:19Z","snapshot_observed_at":"2026-07-06T20:11:33.144418Z","submitted_at":"2024-12-21T20:58:19Z","title":"Assessing Social Alignment: Do Personality-Prompted Large Language Models Behave Like Humans?","version":3},"cited_work":{"arxiv_id":"2412.16772","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.16772","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Assessing social align- ment: Do personality-prompted large language models behave like humans?","venue":null,"work_id":"7ba33215-eee7-450c-860f-b7bd492b6666","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2412.16772","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:73ed82e508909bac05dd3e6f27bd08dd5d7725c82a3527af6a59fd01afeb6ac5","observation_id":"ac4d0d13-4393-417e-a9a8-da0472802c60","resolution":{"observed_at":"2026-05-20T15:33:25.472667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating the ability of large language models to predict human social decisions.Scientific Reports, 15(1):32290","venue":null,"work_id":"391abe7d-ca77-40ab-b944-396fd944fad8","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:6e02562e474463ade152c11f9a078f237d31eb92127bf822ace510e62171ee6e","observation_id":"5992c688-c2d8-46bb-8b6f-c481675a3727","resolution":{"observed_at":"2026-05-20T15:33:25.847690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05555","last_updated":"2025-06-05T20:02:31Z","snapshot_observed_at":"2026-08-04T23:26:29.221219Z","submitted_at":"2025-06-05T20:02:31Z","title":"Using Large Language Models to Simulate Human Behavioural Experiments: Port of Mars","version":1},"cited_work":{"arxiv_id":"2506.05555","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05555","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Using large language models to simulate human behavioural experiments: Port of mars","venue":null,"work_id":"cee80232-39a5-4db9-b288-4488be136f83","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2506.05555","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:1293baba3bd338072a00304f83ea6722918a7f5e5870a3d5e3560fd6eabcbc58","observation_id":"f01acf2a-ebf9-4b87-ab77-5484c7a92d59","resolution":{"observed_at":"2026-05-20T15:33:25.469812Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11581","last_updated":"2025-03-23T13:00:03Z","snapshot_observed_at":"2026-08-02T06:52:32.786538Z","submitted_at":"2024-11-18T13:57:35Z","title":"OASIS: Open Agent Social Interaction Simulations with One Million Agents","version":5},"cited_work":{"arxiv_id":"2411.11581","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11581","snapshot_observed_at":"2026-07-08T17:35:09.835982Z","title":"Oasis: Open agents social interaction simulations on one million agents","venue":"cs.CL","work_id":"98f048b2-1f26-4c7a-b8b5-3e225969f16e","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2411.11581","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:b26dde255f926d1076658941125090edd778e45ceba4fdd5940b072934289db0","observation_id":"edc61dc6-d7d7-4633-8cf6-5c15330a0022","resolution":{"observed_at":"2026-05-20T15:33:25.456855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11667","last_updated":"2024-03-22T18:52:15Z","snapshot_observed_at":"2026-08-01T04:15:49.179138Z","submitted_at":"2023-10-18T02:27:01Z","title":"SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents","version":2},"cited_work":{"arxiv_id":"2310.11667","doi":"10.48550/arxiv.2310.11667","metadata_source":"pith","pith_arxiv_id":"2310.11667","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sotopia: Interactive evaluation for social intelligence in language agents","venue":"cs.AI","work_id":"47b9c80b-5140-4a3e-9d18-d298c3ffac79","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2310.11667","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:2b8f62e9dc2e5dbedc3589d958d2ad5b9f5aa0241252e230dc7899203c7b3c59","observation_id":"c02ffb49-d792-4301-a5fd-655ca4a10490","resolution":{"observed_at":"2026-05-20T15:33:25.492532Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.22546","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think socially via cognitive reasoning","venue":null,"work_id":"d48dd327-83e7-4c40-9faf-dd14d9a2b6fc","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:157acf072f00823dfd34d0878365991a9e64ec3034f5db47e146aa7a16ee840b","observation_id":"40066b96-9045-4e39-a047-92ef8431e9bb","resolution":{"observed_at":"2026-05-20T15:33:25.533789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.22887","last_updated":"2026-04-11T19:17:47Z","snapshot_observed_at":"2026-08-03T03:07:36.105264Z","submitted_at":"2025-09-26T20:07:34Z","title":"Infusing Theory of Mind into Socially Intelligent LLM Agents","version":2},"cited_work":{"arxiv_id":"2509.22887","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.22887","snapshot_observed_at":"2026-07-04T11:09:45.963667Z","title":"Infusing Theory of Mind into Socially Intelligent LLM Agents","venue":"cs.CL","work_id":"2b22ebd4-22b5-491c-8efe-c31d8aefc1f7","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2509.22887","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0942c5029b3b6033f5f561577ea6ea736b9622027eb680c2c52151f0e675f35d","observation_id":"0c3a4f59-4e59-4a1d-8dec-972c6eec63eb","resolution":{"observed_at":"2026-05-20T15:33:25.463149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A foundation model to predict and capture human cognition.Nature, 644(8078):1002–1009","venue":null,"work_id":"2db6d4be-dfc5-4f44-b07b-41cd260d32d2","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0eafa0ebaaca8810c2679de89e64e02eb4d313c840aa8da4c2f4494c2f6dd047","observation_id":"5088f59f-5287-48d0-b613-24305d0d86b3","resolution":{"observed_at":"2026-05-20T15:33:25.840996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:16:36.525107Z","title":"Customer-r1: Personal- ized simulation of human behaviors via rl-based llm agent in online shopping","venue":null,"work_id":"45fde5f0-8cb7-40a1-901f-56ea2eb7b320","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:89f05635bf6c693895adc8bcb54f0b4b099ce15bbbd1c8d29c15b821f73bda2a","observation_id":"1b39f71d-d1fd-4eb2-9c32-4b35a8e541c8","resolution":{"observed_at":"2026-05-20T15:33:25.547663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Customer-r1: per- sonalized simulation of human behaviors via rl-based llm agent in online shopping","venue":null,"work_id":"c85998cc-30f6-4db3-8eba-c620453eca00","year":null},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:f113ebe845ae0f57650d235840357c48e3d4fceed61b83264c363327ba63a59c","observation_id":"17f985c0-07b1-43fb-bc92-83fe902b3ab3","resolution":{"observed_at":"2026-05-20T15:33:25.843015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Using llms for market research.Harvard Business School Marketing Unit Working Paper, (23-062)","venue":null,"work_id":"a4cdc6d2-2910-475b-8c61-5b9ae97f8f43","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0a416e9aa4bd1dc7bf4a0293c5aef73407f5f8694a5486da250912a632734f12","observation_id":"db4a6149-e32b-4074-829f-8fdd1bdce0a1","resolution":{"observed_at":"2026-05-20T15:33:25.834882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The silicon sample: Benchmarking synthetic users against human respondents in market research.Available at SSRN 5835122","venue":null,"work_id":"0698364f-d539-4835-ac96-a09d6e2c953e","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a805e7aa54208bb70fc2510f85c0f23feb57cc38a51e98e759f5351a30de47aa","observation_id":"2b2c3e5d-ebdb-4d61-ad5a-700d045e2d0f","resolution":{"observed_at":"2026-05-20T15:33:25.837161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.01506","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:08:33.651862Z","title":"Twinmarket: A scalable behavioral and social simulation for financial markets","venue":null,"work_id":"15ffe389-1140-4e41-9096-12f3b9880c96","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:6381252187481b593955804233c2dbe5c87e852ceed8539e6b7e9c206cbba0a8","observation_id":"7ab7ca4d-3575-43b0-8dbf-bc726a30ac98","resolution":{"observed_at":"2026-05-20T15:33:25.508922Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Econagent: large language model-empowered agents for simulating macroeconomic activities","venue":null,"work_id":"4ec4484a-cdbd-43d7-8b74-45963880cca4","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:3dbc1a5a03afc2a7d30f38645e0b5243e21eef76de38fe9adf7c522728a960a3","observation_id":"39013794-015c-4535-b16f-e2c1ba56e2a9","resolution":{"observed_at":"2026-05-20T15:33:25.888507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9a394b1d-f29a-4a42-964d-e6047ebda1ee","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:250297706c7833ebda5faf513381c4e665aaa9bee676429c0615f05189103bb5","observation_id":"0869a374-2271-440c-8aa5-4656ba34b56d","resolution":{"observed_at":"2026-05-20T15:33:25.839010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07054","last_updated":"2026-04-09T07:49:38Z","snapshot_observed_at":"2026-08-02T09:08:32.703047Z","submitted_at":"2026-04-08T13:06:37Z","title":"Sell More, Play Less: Benchmarking LLM Realistic Selling Skill","version":2},"cited_work":{"arxiv_id":"2604.07054","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07054","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sell More, Play Less: Benchmarking LLM Realistic Selling Skill","venue":"cs.CL","work_id":"cef532d0-4ec5-4274-b829-13e942bc3a3e","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2604.07054","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:6e1799cec0c7518e8805a7d517293ddfe019bc70cb29e71b932c89e72ae18791","observation_id":"d2012155-d397-445e-97d2-a805534a4dea","resolution":{"observed_at":"2026-05-20T15:33:25.525136Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.25110","last_updated":"2026-05-28T20:58:46Z","snapshot_observed_at":"2026-08-04T07:39:18.616758Z","submitted_at":"2025-10-29T02:21:10Z","title":"DEBATE: A Large-Scale Benchmark for Evaluating Opinion Dynamics in Role-Playing LLM Agents","version":6},"cited_work":{"arxiv_id":"2510.25110","doi":"10.48550/arxiv.2510.25110","metadata_source":"pith","pith_arxiv_id":"2510.25110","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Debate: A large-scale benchmark for role-playing llm agents in multi-agent, long-form debates","venue":"cs.CL","work_id":"180a312f-0358-4556-867e-8d2b7f657e74","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2510.25110","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:38b14c20ad37cf868bdbb2fa1d229925d2f9d3d8cba43c2c5aaf497b7c0c1b42","observation_id":"042e5ff0-7b40-4cbf-be00-7de2a274aa4b","resolution":{"observed_at":"2026-06-01T02:02:21.388075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.01351","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T03:06:29.871479Z","title":"Benchmark- ing overton pluralism in llms","venue":null,"work_id":"5c0ea09d-a071-4ea8-a18a-88833f2ce598","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:44aec5871791f2b93aa20e76b3f00737fbe30ba4dcf06614831ac3f870fee643","observation_id":"ce38863d-f1a8-4266-9729-eb0be4ec3376","resolution":{"observed_at":"2026-05-20T15:33:25.453979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b8f37976-f86d-41bc-9ac0-f17817c5ffb9","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:085a8a3e640c04334587af3d6958af2fe4cf2d754294c92d8475f7fbe02c45c2","observation_id":"e67efb38-2b08-401e-908e-6b7901a976d5","resolution":{"observed_at":"2026-05-20T15:33:25.828688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.17087","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:08:55.853323Z","title":"arXiv preprint arXiv:2601.17087 , year=","venue":null,"work_id":"1e07215b-a63b-418a-8387-6f3ccef28361","year":2026},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:e8ef1e2bef7d66de2680de36195d776ea2be6be054c9f1fac41aeafffa051451","observation_id":"4860810f-253d-42de-9ebe-a9eeb71a11df","resolution":{"observed_at":"2026-05-20T15:33:25.515664Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17227","last_updated":"2024-01-30T18:53:30Z","snapshot_observed_at":"2026-08-05T22:06:16.866709Z","submitted_at":"2023-11-28T20:59:49Z","title":"War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World Wars","version":2},"cited_work":{"arxiv_id":"2311.17227","doi":"10.48550/arxiv.2311.17227","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.17227","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"War and peace (waragent): Large language model-based multi-agent simulation of world wars","venue":"arXiv (Cornell University)","work_id":"39a0d911-0007-4deb-9809-d7a9d241d450","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2311.17227","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:8d55020587badd9f65bb4cbe4cf5dfef0e86304d4c59a58b1a3731fed0a42a68","observation_id":"bc7c261d-24d0-4010-8c03-ba1b4b234d8b","resolution":{"observed_at":"2026-05-20T15:33:25.475698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14984","last_updated":"2025-06-03T23:11:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-27T16:24:56Z","title":"S$^3$: Social-network Simulation System with Large Language Model-Empowered Agents","version":3},"cited_work":{"arxiv_id":"2307.14984","doi":"10.1146/annurev-soc-060116-053450","metadata_source":"pith","pith_arxiv_id":"2307.14984","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S$^3$: Social-network Simulation System with Large Language Model-Empowered Agents","venue":"cs.SI","work_id":"ae6d9bb2-30d7-4b8c-8140-bcb69cc5c24c","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2307.14984","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:272467adc8950419c6749b9ce11ccb8dfe9bbd090945d1f1d9a5839df0727aad","observation_id":"84154301-bf51-4574-a4d9-8e8123efaae9","resolution":{"observed_at":"2026-05-20T15:33:25.428676Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gensim: A general social simulation platform with large language model based agents","venue":null,"work_id":"97ef190a-368b-45ea-a8b6-77e0b3cd3366","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:2f1e0d4df9ea50f4ae3da0d42428547fe127340f6ab22db1feb2e686bad53f91","observation_id":"07eb2c06-7b83-410e-8066-c57417409ad5","resolution":{"observed_at":"2026-05-20T15:33:25.818590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10157","last_updated":"2025-07-15T11:14:36Z","snapshot_observed_at":"2026-07-06T21:09:03.012115Z","submitted_at":"2025-04-14T12:12:52Z","title":"SocioVerse: A World Model for Social Simulation Powered by LLM Agents and A Pool of 10 Million Real-World Users","version":3},"cited_work":{"arxiv_id":"2504.10157","doi":"10.48550/arxiv.2504.10157","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10157","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Socioverse: A world model for social simulation powered by llm agents and a pool of 10 million real-world users","venue":"ArXiv.org","work_id":"eb68f0d5-51f6-43b9-8568-990fbcf1fa4b","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2504.10157","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:17f8d238cdbd136940b9420e98dff7f7f5ba63f1d07f699b9b736bc543da264d","observation_id":"8140fc86-338e-45d4-8672-d9d7c9c48807","resolution":{"observed_at":"2026-05-20T15:33:25.459810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agentverse: Facilitating multi-agent collaboration and exploring emergent behaviors","venue":null,"work_id":"5648778f-6cf1-4a78-b897-35c1e29c6598","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:402cc7f7f6d81869f836074f4580f8f47e47381f57f7d2eff02b29855bd84b29","observation_id":"f83298ed-7945-4add-bf68-0483c7a8d757","resolution":{"observed_at":"2026-05-20T15:33:25.860444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Megaagent: A large-scale autonomous llm-based multi-agent system without predefined sops","venue":null,"work_id":"348ead06-38c6-409c-afda-8bfac7b69e63","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:3eb72a66487615aa33d8f40f8adef855e95d0cc3e1514cc774a96e560d3efe6b","observation_id":"81cf94cc-f494-4294-96d9-79467c828b62","resolution":{"observed_at":"2026-05-20T15:33:25.862629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11401","last_updated":"2025-05-16T16:09:28Z","snapshot_observed_at":"2026-08-04T13:29:20.777931Z","submitted_at":"2025-05-16T16:09:28Z","title":"Can AI automatically analyze public opinion? A LLM agents-based agentic pipeline for timely public opinion analysis","version":1},"cited_work":{"arxiv_id":"2505.11401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11401","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can ai automatically analyze public opinion? a llm agents-based agentic pipeline for timely public opinion analysis","venue":null,"work_id":"720fcc60-81fb-4eab-a263-4c0a8cc2a801","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2505.11401","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:830ca97c89bd907ccd1bb20e718bfa7480db59e7a23afab7c242beaad62f38f8","observation_id":"8842821f-91da-4602-bd4e-beef06232e7b","resolution":{"observed_at":"2026-05-20T15:33:25.481805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models empowered agent-based modeling and simulation: A survey and perspectives.Humanities and Social Sciences Communications, 11(1):1–24","venue":null,"work_id":"ea23fe86-0972-43dc-af27-f4dfde89c03f","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:2c30a50b2344832a275b28f2c34ac66417e83231096f3acbe836726100d8e7e0","observation_id":"fe346f48-4da1-46ed-9117-35be36366bf6","resolution":{"observed_at":"2026-05-20T15:33:25.814351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From persona to personalization: A survey on role-playing language agents.Transactions on Machine Learning Research","venue":null,"work_id":"d1fe0673-d0b8-4937-a868-ac4eecb018e2","year":null},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:7822a22ce5913a4c81788004188e013eb64e2f9a63c4d65b4d1fe782c0b6db36","observation_id":"a8c521e4-b883-4591-90cd-f5ed6d352667","resolution":{"observed_at":"2026-05-20T15:33:25.816420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T11:56:13.195130Z","title":"Synthetic replacements for human survey data? the perils of large language models.Political Analysis, 32(4):401–416","venue":null,"work_id":"83549a1e-c4bc-4faf-83a6-82be593a317f","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:359fefc2aa40761afd3f77bcf0742a1cbfbdca485bac056913720673b97e46b9","observation_id":"45c49806-32a5-4b74-b70b-635997ea5c0d","resolution":{"observed_at":"2026-05-20T15:33:25.820599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Social iqa: Commonsense reasoning about social interactions","venue":null,"work_id":"24aa0b3e-80d5-43bd-9de5-2289533a7b8f","year":2019},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:d20d09d9b00e82735e0d2f7dd8c3e64d8b86589c712409d8201138f33c678715","observation_id":"e53e248b-09f9-40b9-bb40-3e35b739feba","resolution":{"observed_at":"2026-05-20T15:33:25.826665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do llms have distinct and consistent personality? trait: Personality testset designed for llms with psychometrics","venue":null,"work_id":"9dd6b084-5660-4942-a866-e1bf12ab2aa6","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:c24ee33e645473abf7a61c71d5bf78898acd10c27f8a8c795e224b3a1c4f3605","observation_id":"8cb3ad73-1102-4d5e-b226-b80e8d608fb8","resolution":{"observed_at":"2026-05-20T15:33:25.867962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Psychcounsel-bench: Evaluating the psychology intelligence of large language models","venue":null,"work_id":"99f0a966-0243-49f3-ada1-cd0a77c9d153","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:4d884c9945b4889e60cee9732f73cf1a99557ac385a06154e821c329746e56e7","observation_id":"409fd761-6c8f-4d48-b20c-1ff5219ee580","resolution":{"observed_at":"2026-05-20T15:33:25.439053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Socialbench: Sociality evaluation of role-playing conversational agents","venue":null,"work_id":"7fd879fa-1b4c-4760-a9d6-6542ccdde8f5","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0c29aea15eabd03c8a2c916e1a73838f022bff8f15bbbc0274dd949f3711b27a","observation_id":"c22d2e3d-4bad-4ffb-8d97-efb883e3d3ef","resolution":{"observed_at":"2026-05-20T15:33:25.808469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The greatest good benchmark: Measuring llms’ alignment with utilitarian moral dilemmas","venue":null,"work_id":"3e83de60-6aa8-4921-a0bb-095f14e6f27f","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0b35065944809123b1827ca0aa362ccc88d667a26b7005f30808c492124e4693","observation_id":"4b666605-e9f3-4d96-bb49-97eac0473990","resolution":{"observed_at":"2026-05-20T15:33:25.810336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Social-r1: Enhancing social intelligence in LLMs through human-like reinforced reasoning","venue":null,"work_id":"98eed7e3-315d-4025-8023-a6afc5b3398f","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:41d58ba3049e5e7189cddc1c3401b20dff0d5248536c1ec6b8bbf691b9bf3cd8","observation_id":"45470683-65b6-4738-9fd1-6dc8b02d51ba","resolution":{"observed_at":"2026-05-20T15:33:25.804528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13065","last_updated":"2025-06-16T03:18:28Z","snapshot_observed_at":"2026-07-06T21:42:39.512889Z","submitted_at":"2025-06-16T03:18:28Z","title":"MotiveBench: How Far Are We From Human-Like Motivational Reasoning in Large Language Models?","version":1},"cited_work":{"arxiv_id":"2506.13065","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13065","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motivebench: How far are we from human-like motivational reasoning in large language models?","venue":null,"work_id":"963e3526-9c0c-4a3b-bf57-91fe24fa8dea","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2506.13065","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0fe493a910b02a4f66e567e5edf513faa3f06e9f903c6cca3aa487082b2b9715","observation_id":"3eb5105e-3f69-4b94-8008-38b16aec4baa","resolution":{"observed_at":"2026-05-20T15:33:25.522229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emobench: Evaluating the emotional intelligence of large language models","venue":null,"work_id":"86eae5cd-73ea-4831-8814-9f4185789859","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:f6591adafe448e6c71436469b98f9058474de3c8eac8e221e8934206a96f0e73","observation_id":"dc512d22-16f0-4a44-a59f-6499bb90115c","resolution":{"observed_at":"2026-05-20T15:33:25.812222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.03922","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:29:59.531643Z","title":"Hssbench: Benchmarking humanities and social sciences ability for multimodal large language models","venue":null,"work_id":"88ee92d9-e38d-4285-8296-0d0298dd8b90","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:5eac4a1ac30f70ea7fa93259bf6dcae309345f93f77fe2e3f911fb2a8a7dbc77","observation_id":"d761669d-a7f3-482b-a0e8-b8b0b6c6f9eb","resolution":{"observed_at":"2026-05-20T15:33:25.422500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aligning {ai} with shared human values","venue":null,"work_id":"ddc5bf07-cdac-44ce-9f64-f0b27d2d1127","year":2021},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0d02946e601cf13ce5c8cd4bb5ab7704f6cb2b557ddc78b79c0fadae586418b2","observation_id":"22a60ab0-48cb-4ca0-9ae7-1bd9d6d38506","resolution":{"observed_at":"2026-05-20T15:33:25.806446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10158","last_updated":"2023-12-14T11:49:17Z","snapshot_observed_at":"2026-08-05T23:26:32.216156Z","submitted_at":"2023-10-16T07:58:56Z","title":"Character-LLM: A Trainable Agent for Role-Playing","version":2},"cited_work":{"arxiv_id":"2310.10158","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.10158","snapshot_observed_at":"2026-07-01T22:46:20.043049Z","title":"Character-llm: A trainable agent for role-playing","venue":null,"work_id":"47a23441-c399-4f23-ab01-dd9827b4b92f","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2310.10158","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a4e1516b4d08126815baba92823360269735642287edf5e4ffb738c9df7f2915","observation_id":"af9418ff-9aff-4d17-9db8-39d09e9f4fad","resolution":{"observed_at":"2026-05-20T15:33:25.431988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Incharacter: Evaluating personality fidelity in role-playing agents through psychological interviews","venue":null,"work_id":"e4441ade-2f0e-4de6-afc3-4a4c176bae24","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:ce2374a80e322d690bd0c52d70723f39d38592e9aa2fe863fe8146eb0cf07b9a","observation_id":"4269aac6-c4e4-49ef-a8a0-af6890f6b971","resolution":{"observed_at":"2026-05-20T15:33:25.822608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PersonaGym: Evaluating persona agents and LLMs","venue":null,"work_id":"c23de865-20e8-4214-b67f-895e75d92723","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:b1fb17e98a476182a6db4b8d08944ec589f18a5d2646d4968d48d41a4cbdacc1","observation_id":"dc13344c-4c29-4c4b-a339-cd6897b8db6a","resolution":{"observed_at":"2026-05-20T15:33:25.830504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Klinkert, Steph Buongiorno, and Corey Clark","venue":null,"work_id":"906c1c36-8ac5-4e95-9a60-3cfa8058240b","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:56ab7847089adea599f05cce08b40842a4255b5a57c73be4e33a0fce706aa42a","observation_id":"6580d000-6e5f-496f-a8c0-2d41e9248082","resolution":{"observed_at":"2026-05-20T15:33:25.925881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04899","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T23:35:07.735420Z","title":"Human behavior atlas: Benchmarking unified psychological and social behavior understanding","venue":null,"work_id":"eb0c58d9-27af-4afc-b0e0-dfc7b0cabca6","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:3b4d010aeab81eafc8db800f7d34135388b55bfb5601483a2b16c63f7858361c","observation_id":"05ed3609-cc0c-4e4f-81a8-995dab10acfa","resolution":{"observed_at":"2026-05-20T15:33:25.544391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AgentSense: Benchmarking social intelligence of language agents through interactive scenarios","venue":null,"work_id":"ddc71677-1092-48c1-90f3-c671638091d0","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:18964e8effd79841a5d49c1d10f1de65e54a686cdd99ab231fe41eb057b5682c","observation_id":"2a589372-e2ef-46b4-b1c7-86aee41d0fcf","resolution":{"observed_at":"2026-05-20T15:33:25.915231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a2955389-a5b0-4976-847e-7bfa924a8c67","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:94be1472c5bbd39df9fd1c7f3be77a0bc997f3f50e3f47fea4a28094488d60b4","observation_id":"1350a6ce-e1dd-44dd-9706-f9c86aaf23f9","resolution":{"observed_at":"2026-05-20T15:33:25.912582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Moral stories: Situated reasoning about norms, intents, actions, and their consequences","venue":null,"work_id":"77c67329-2808-40fb-8d8b-49758c287662","year":2021},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:2882fe29f4eb0fc011b509d8a85c0f88111340def8d10160923f365a30c7ee37","observation_id":"22b6b6b3-ed20-4360-944a-304ccf36c819","resolution":{"observed_at":"2026-05-20T15:33:25.917522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotionqueen: A benchmark for evaluating empathy of large language models","venue":null,"work_id":"6caee5ed-6622-4e71-a41e-b5f42b4ab35d","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:354d2cbfada8a8f0f61205f08f155794564a68998b4fb82c475e5a90b4d454f8","observation_id":"33500b69-f0f0-4fe2-95c6-b12a24663a43","resolution":{"observed_at":"2026-05-20T15:33:25.921825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interintent: Investigating social intelligence of llms via intention understanding in an interactive game context","venue":null,"work_id":"86f34ef0-54be-42a6-a912-9aec6fe9b3cc","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:ef5bb38bc986470c5db8bc3b44b7e19d2d93e796f5fd595ae64b9f81a5e9fddc","observation_id":"e3140a78-ee74-4a64-bb1f-e221deeb8238","resolution":{"observed_at":"2026-05-20T15:33:25.910704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding social reasoning in language models with language models.Advances in Neural Information Processing Systems, 36:13518–13529","venue":null,"work_id":"0bd5b972-8aad-45c1-87dd-85a6968228c6","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:13ee938959db460f946eae35028a545645b9ad436302610fac35686f2339ece1","observation_id":"0346deb8-9dbc-4fc1-8a4e-abf40f9649ce","resolution":{"observed_at":"2026-05-20T15:33:25.934652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cognitive bias in decision-making with llms","venue":null,"work_id":"45d5db22-373c-4254-9d9b-b7cde464972b","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a934ea3d6531a5781fe25b198fd8a8d96d1d5845694d44b888e0e0d202cec771","observation_id":"6af01a38-915b-48bb-a45c-46613bb4b9b7","resolution":{"observed_at":"2026-05-20T15:33:25.892757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decision-making behavior evaluation framework for llms under uncertain context.Advances in neural information processing systems, 37:113360–113382","venue":null,"work_id":"a6521865-bd08-4179-b31e-9c7140a5be49","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:6c46e2a7aec1b957bdd0b97a1e094be84c3452a6c77b857f4386ed2e88d21074","observation_id":"52d1b9c7-355e-4209-ba9c-caaf7f51b1a7","resolution":{"observed_at":"2026-05-20T15:33:25.894872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tomato: Verbalizing the mental states of role-playing llms for benchmarking theory of mind","venue":null,"work_id":"9977724c-067f-41fd-8057-447ba2c5fb75","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a15133c33087560952605e00870efb06b827789b260159fb9dfa2091cd3d2e58","observation_id":"0b9ffb7c-f634-4fab-a9eb-a9e4bb9b179c","resolution":{"observed_at":"2026-05-20T15:33:25.903737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testing theory of mind in large language models and humans.Nature Human Behaviour, 8(7):1285–1295","venue":null,"work_id":"e5609b21-3acb-400a-b4e1-5cff9f26f06b","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a357a829d771be15baa304e5c56064f086f2bbf0930b3090dc24231a9f368eae","observation_id":"f7471e29-68d1-4cf3-9b1f-9d4fe575e12f","resolution":{"observed_at":"2026-05-20T15:33:25.890745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hi-tom: A benchmark for evaluating higher-order theory of mind reasoning in large language models","venue":null,"work_id":"d6aba033-1162-4b0e-b72f-9f9386b7af4e","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:d9b0992661441fbdb823f07a2c4b3c85e91126de7d2fa6889b45b3d7b0197f13","observation_id":"32371c9c-af36-45c3-8ccc-5ad09d3f2b52","resolution":{"observed_at":"2026-05-20T15:33:25.901770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Muma-tom: Multi-modal multi-agent theory of mind","venue":null,"work_id":"9af9c950-49f2-43ca-a279-c7def8e47b70","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:7d213cefe4da1e568f6d7041fc45b334cea2fcd11f9dfda4634b14328e04f4cd","observation_id":"8d9e0426-ad20-4220-b6a8-898dea4db83a","resolution":{"observed_at":"2026-05-20T15:33:25.929948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.00003","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The mind in the machine: A survey of incorporating psychological theories in llms","venue":null,"work_id":"e8f316c2-7fbf-4f0b-af4d-211424e0cd12","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:c0bb73efe97d274b7884fef6a5baa660437ce0f1f107fc32fc3f6c6e67b8f93c","observation_id":"7ea9f07a-4d0e-4f5b-84ba-b79bd2f3bbdd","resolution":{"observed_at":"2026-05-20T15:33:25.500975Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04638","last_updated":"2025-09-07T14:25:23Z","snapshot_observed_at":"2026-07-06T18:58:30.942582Z","submitted_at":"2024-07-30T08:12:04Z","title":"Affective Computing in the Era of Large Language Models: A Survey from the NLP Perspective","version":2},"cited_work":{"arxiv_id":"2408.04638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.04638","snapshot_observed_at":"2026-07-02T16:07:08.899261Z","title":"Affective computing in the era of large language models: A survey from the nlp perspective","venue":null,"work_id":"3812c47c-f43a-4e7d-8b1f-a7aece232198","year":2024},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"cited_paper":"/paper/2408.04638","citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:2b7d71801676363497829b55182553f3fdceced685c34f0671f76c2ae92aa00c","observation_id":"58d3cfdf-9476-45df-b0db-cd326e60d0cd","resolution":{"observed_at":"2026-05-20T15:33:25.484748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Argyle, Ethan C","venue":null,"work_id":"10701375-5285-4f60-87bb-78f904d44675","year":2023},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:631824f88ce9059e7c99340a18d8b8e6657b759b1ca445c0c4364c32dce63ec3","observation_id":"b4c08b27-a6b2-4f9a-bebd-9d8f1d6633c9","resolution":{"observed_at":"2026-05-20T15:33:25.865087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Doubleday","venue":null,"work_id":"9ee0de68-6d59-4fee-b5cd-1109865269ef","year":1959},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:531a2617d397825428927d07b7771e15d333032f2feb35e82b2131cc0672d13c","observation_id":"ed0a8d77-0004-4ad2-acf2-23a60057c91b","resolution":{"observed_at":"2026-05-20T15:33:25.870067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Harvard University Press","venue":null,"work_id":"2d74c0fa-5f7b-4e11-8c78-e602a3403d73","year":1984},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:332fba1450dc046265d57f383d982e3e51c4ff28d5d2d5bc8a70ab2a85293ffd","observation_id":"0a4d88f6-4581-49ff-a611-811a01528f84","resolution":{"observed_at":"2026-05-20T15:33:25.875915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"predict every pair as positive","venue":null,"work_id":"c569d386-102e-478a-a580-fbf23812036c","year":1979},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:a4f63a9864b3a87ce123a723f1ef4d4e62572ade5945d9306f6a406d6ab7b085","observation_id":"a94b41e0-6830-4956-b661-9af1fe6b2d54","resolution":{"observed_at":"2026-05-20T15:33:25.851792Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Apple released a phone","venue":null,"work_id":"aecbc2cd-d02b-4800-8576-e37ce53a6efe","year":2025},"citing_paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-20T15:31:25.079191Z"},"links":{"citing_paper":"/paper/2605.17079"},"observation_digest":"sha256:0af6e6c26def91a20aa8e2b59ee52e17891627bc3d4e343a7a11d86c9b8b86c9","observation_id":"5e7a63e0-8295-45fb-884d-7fea5663720d","resolution":{"observed_at":"2026-05-20T15:33:25.856228Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.17079","last_updated":"2026-05-16T16:55:31Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T16:55:31Z","title":"Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":35,"verified_fuzzy":56},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 0 inbound Pith citation observations for arXiv:2605.17079."}