{"as_of":"2026-08-20T21:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a578e53a577c705826dbe839170fe0dc847de6e1d8f758191a0455b0624bd2b","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T02:00:28.010591Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14485/citation-record","integrity":"/paper/2607.14485/integrity","json":"/paper/2607.14485/citation-record.json","paper":"/paper/2607.14485"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-02T02:00:24.684348Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:24.684348Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:a51d95a66a986ae33c61e49ec04bb07c2dd93bbbac6abe6d0b36c3e770cb60a5","observation_id":"a82f15b2-aa5d-40d2-b613-9b039736ddbf","resolution":{"observed_at":"2026-08-02T02:00:24.684348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:24.767236Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:24.767236Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:9d0862c3d1c0116f534cda004e545346f64d981042e0be8adf9f8eedcb75b597","observation_id":"30e12c8c-8077-4811-a976-91ca2e4580ba","resolution":{"observed_at":"2026-08-02T02:00:24.767236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:24.926769Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:24.926769Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:399245a91b980352d5db7301d6d931527807b826792122c683a7145796145ce1","observation_id":"48cd5449-1d03-4518-bfc9-53a10edd9b3d","resolution":{"observed_at":"2026-08-02T02:00:24.926769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10848","last_updated":"2023-10-23T05:05:15Z","snapshot_observed_at":"2026-08-17T11:26:57.477995Z","submitted_at":"2023-08-21T16:47:11Z","title":"AgentVerse: Facilitating Multi-Agent Collaboration and Exploring Emergent Behaviors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10848","snapshot_observed_at":"2026-08-02T02:00:24.995262Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:24.995262Z"},"links":{"cited_paper":"/paper/2308.10848","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:0a301e62998e51c083b627021ad61dddec7cd4086917681766d0c9dec0be1fbf","observation_id":"f9702a56-d19f-4e14-b6a7-955d488c65df","resolution":{"observed_at":"2026-08-02T02:00:24.995262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:25.062255Z","title":"In: NeurIPS 2024 Workshop on Open-World Agents (2024), https://openreview.net/forum?id=irKHAnZjvc","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.062255Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:3d61d32c075bb4e0c83e906e21932013bdc20720a3bcf484b3bddda264aaeafb","observation_id":"b6d823d9-619a-4f5d-8804-a3fcd9ec1517","resolution":{"observed_at":"2026-08-02T02:00:25.062255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-08-17T01:58:07.850738Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-02T02:00:25.128382Z","title":"arXiv preprint arXiv:2512.02556 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.128382Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:4adee416445d2819fdd7fe3e3c59e73df02d5d2c9a51676c4a2641d0b66c4e92","observation_id":"0b6bfd86-578b-4d49-af0e-f0ca085e2c2c","resolution":{"observed_at":"2026-08-02T02:00:25.128382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05344","last_updated":"2023-10-09T02:11:21Z","snapshot_observed_at":"2026-08-16T14:53:59.933606Z","submitted_at":"2023-10-09T02:11:21Z","title":"SteerLM: Attribute Conditioned SFT as an (User-Steerable) Alternative to RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05344","snapshot_observed_at":"2026-08-02T02:00:25.187877Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.187877Z"},"links":{"cited_paper":"/paper/2310.05344","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:22f3b6e7bf6074e3e8655c6dc0b6c4693e44219f42de7f237ed967391f3a3eea","observation_id":"75b356a4-3b6e-4008-a853-ca5d470408ca","resolution":{"observed_at":"2026-08-02T02:00:25.187877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.01297","last_updated":"2026-04-02T19:31:59Z","snapshot_observed_at":"2026-08-07T11:05:32.251558Z","submitted_at":"2025-10-01T10:27:01Z","title":"SimCity: Multi-Agent Urban Development Simulation with Rich Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.01297","snapshot_observed_at":"2026-08-02T02:00:25.248941Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.248941Z"},"links":{"cited_paper":"/paper/2510.01297","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:d2c2bb4c50e7608ada8542362b83c9ac060cf8a585f0cb5438f5864999d813e1","observation_id":"0d1f99dd-f548-4886-8cd5-8b53c2925f07","resolution":{"observed_at":"2026-08-02T02:00:25.248941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T02:00:25.338300Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.338300Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:d9ade0fcb2d6bfddcac15fe8be3ba730280c7798ca5f1200df76f5fc8c11cec9","observation_id":"61b345f4-f308-4175-a4ea-4f0a9f0f91a5","resolution":{"observed_at":"2026-08-02T02:00:25.338300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09639","last_updated":"2025-07-13T07:36:02Z","snapshot_observed_at":"2026-08-17T01:37:57.344737Z","submitted_at":"2025-03-12T02:54:15Z","title":"Can A Society of Generative Agents Simulate Human Behavior and Inform Public Health Policy? A Case Study on Vaccine Hesitancy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09639","snapshot_observed_at":"2026-08-02T02:00:25.429954Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.429954Z"},"links":{"cited_paper":"/paper/2503.09639","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:bfecc80d0ae6fceb449b5a6861fcad972343a8d67c87d309cf33f43b948821e9","observation_id":"30b36532-ec40-4c68-ae61-9bb4247ea57b","resolution":{"observed_at":"2026-08-02T02:00:25.429954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-20T11:16:30.984514Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-02T02:00:25.508169Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.508169Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:be007e90100b2e97d4dbb38fb60e5183a3f0dc268d0063f90c995101ca446c91","observation_id":"dd406a54-ffe1-4442-ad2e-102896795bda","resolution":{"observed_at":"2026-08-02T02:00:25.508169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15838","last_updated":"2024-12-30T07:27:58Z","snapshot_observed_at":"2026-08-16T14:52:33.599355Z","submitted_at":"2024-12-20T12:27:16Z","title":"Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15838","snapshot_observed_at":"2026-08-02T02:00:25.588376Z","title":"Gao et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.588376Z"},"links":{"cited_paper":"/paper/2412.15838","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:0f228335ead7b65d2d3a5936e08f0c712ea7462813c542e60842dff57ffc3ecb","observation_id":"1ab7cce1-dd4d-47eb-b7be-dc48274b0e9f","resolution":{"observed_at":"2026-08-02T02:00:25.588376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02718","last_updated":"2024-06-17T10:44:44Z","snapshot_observed_at":"2026-08-18T14:23:11.277862Z","submitted_at":"2024-04-03T13:20:36Z","title":"Evolving Agents: Interactive Simulation of Dynamic and Diverse Human Personalities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02718","snapshot_observed_at":"2026-08-02T02:00:25.670389Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.670389Z"},"links":{"cited_paper":"/paper/2404.02718","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:7a6e6038c1658eece75b12bdeacd161472247ceb94fdc843f0a0ddbf809446b1","observation_id":"2853061f-cdd7-4527-8da4-2389ed905b9f","resolution":{"observed_at":"2026-08-02T02:00:25.670389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10436","last_updated":"2024-05-24T02:53:59Z","snapshot_observed_at":"2026-08-20T04:17:33.517431Z","submitted_at":"2023-10-16T14:19:40Z","title":"EconAgent: Large Language Model-Empowered Agents for Simulating Macroeconomic Activities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10436","snapshot_observed_at":"2026-08-02T02:00:25.758316Z","title":"org/abs/2310.10436","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.758316Z"},"links":{"cited_paper":"/paper/2310.10436","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:c651be6e4acaec1598bdc76a5d68eae228ce1f3a87cf534f028d8a8a8aee6590","observation_id":"a2397c2d-6b04-4d84-82f7-258e130bf0e4","resolution":{"observed_at":"2026-08-02T02:00:25.758316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3711032","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the ACM on Human-Computer In- teraction 9(2), 1–27 (May 2025)","venue":"Proceedings of the ACM on Human-Computer Interaction","work_id":"1ca53c7f-56f0-42c8-b4fa-6e1cecf22406","year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.838765Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:a2c63a53e02febe52926f93e2b82c5a6a8c4803a7c94d8037bb91d17e78280cd","observation_id":"93644310-403b-4b8c-ab09-c0b3c35ce6bc","resolution":{"observed_at":"2026-08-02T02:04:24.214102Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16960","last_updated":"2023-10-28T09:02:39Z","snapshot_observed_at":"2026-08-16T15:29:18.165388Z","submitted_at":"2023-05-26T14:17:36Z","title":"Training Socially Aligned Language Models on Simulated Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16960","snapshot_observed_at":"2026-08-02T02:00:25.923006Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:25.923006Z"},"links":{"cited_paper":"/paper/2305.16960","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:213c0eb5b71e9bb335ec31d97a0084763dbbd5e6b6f8ab60b3a0034652269dfa","observation_id":"f6c4bcf1-e2be-4db6-b782-662abb82fe78","resolution":{"observed_at":"2026-08-02T02:00:25.923006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06904","last_updated":"2025-05-11T08:51:56Z","snapshot_observed_at":"2026-08-15T22:27:32.667091Z","submitted_at":"2025-05-11T08:51:56Z","title":"EcoLANG: Efficient and Effective Agent Communication Language Induction for Social Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06904","snapshot_observed_at":"2026-08-02T02:00:26.009420Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.009420Z"},"links":{"cited_paper":"/paper/2505.06904","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:c66df67ce6b8fcac185497ea29fcce36c2dacd5fe100b4134fd5e18b1951fe07","observation_id":"facf3953-88c1-4ffe-87bb-c367a4a38c44","resolution":{"observed_at":"2026-08-02T02:00:26.009420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:26.093968Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.093968Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:7fdb056d45e591201da3a59ae2abfcc2bbc82068983e51e9ad774f349f9dd362","observation_id":"7c4fb36e-b61b-4147-b7b0-297db6671585","resolution":{"observed_at":"2026-08-02T02:00:26.093968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:26.154811Z","title":"https://openai.com/index/hello-gpt-4o/ (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.154811Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:0df29e470110d8c9922d9dcb788e6930d25b3aae240f6779784813a1ab399308","observation_id":"1cf291a1-a3cd-4bc5-9fd0-6502977cdc9e","resolution":{"observed_at":"2026-08-02T02:00:26.154811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:26.230560Z","title":"https://openai.com/index/ new-embedding-models-and-api-updates/ (2024), accessed: 2026-01-18","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.230560Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:76fa19ece802cab8f38e4a9f1aa097c5fd2df65a26648b9fe885f0d12b782465","observation_id":"d0d48d91-2dfd-45f3-a955-db6f12b49853","resolution":{"observed_at":"2026-08-02T02:00:26.230560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:26.313387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.313387Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:54c2e3b9a0020d47f77ef2967328263ae1dad5bdac4c9aa21277cfbcde75712a","observation_id":"c5c84dfa-bda3-49b4-8e26-c896bd4b407e","resolution":{"observed_at":"2026-08-02T02:00:26.313387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-02T02:00:26.394888Z","title":"org/abs/2203.02155","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.394888Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:230b2433597f845848b25a166f74af8556d03633eda32096a18adcc77bda3058","observation_id":"c501a1fd-1304-4dba-a283-1c88851c3315","resolution":{"observed_at":"2026-08-02T02:00:26.394888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03442","last_updated":"2023-08-06T00:21:19Z","snapshot_observed_at":"2026-08-16T03:49:04.888755Z","submitted_at":"2023-04-07T01:55:19Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03442","snapshot_observed_at":"2026-08-02T02:00:26.471162Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.471162Z"},"links":{"cited_paper":"/paper/2304.03442","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:30224e61b9108268a73f8bcf123f8d3e9310b32ff5238f77d88f79b04d5f0f48","observation_id":"ed8bf4e9-aede-4b99-8136-2c8d6309569b","resolution":{"observed_at":"2026-08-02T02:00:26.471162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10109","last_updated":"2026-06-28T22:37:51Z","snapshot_observed_at":"2026-08-13T12:33:17.230204Z","submitted_at":"2024-11-15T11:14:34Z","title":"LLM Agents Grounded in Self-Reports Enable General-Purpose Simulation of Individuals","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10109","snapshot_observed_at":"2026-08-02T02:00:26.555851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.555851Z"},"links":{"cited_paper":"/paper/2411.10109","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:dd46561956e7270060ca2c3c8e0ed92fddaa60b5968c6bdc17255fbe17609e02","observation_id":"7f715d9f-389c-44b8-b1da-51fb239e149b","resolution":{"observed_at":"2026-08-02T02:00:26.555851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08691","last_updated":"2026-04-10T15:11:22Z","snapshot_observed_at":"2026-08-16T11:37:43.086955Z","submitted_at":"2025-02-12T15:27:07Z","title":"AgentSociety: Large-Scale Simulation of LLM-Driven Generative Agents Advances Understanding of Human Behaviors and Society","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08691","snapshot_observed_at":"2026-08-02T02:00:26.642458Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.642458Z"},"links":{"cited_paper":"/paper/2502.08691","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:0dcdbc926293f5cfdd937878f4a7b789f39f06aa1a6f7b89e1908a4f16e989e5","observation_id":"38ae0cb9-8b3e-4088-b092-be01ca05d9db","resolution":{"observed_at":"2026-08-02T02:00:26.642458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-02T02:00:26.728290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.728290Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:bc661d326741979dca20395e9244f3114f56e2f9ab4da33af17e0dc5edc3ad23","observation_id":"8f6a53d5-4620-48c9-a38b-5933bbd330c8","resolution":{"observed_at":"2026-08-02T02:00:26.728290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T02:00:26.840373Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.840373Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:50039ea38bb533068dd2dffb0ed3e8485bc3ada8a48cabcf23baaeff636b4e9a","observation_id":"3ba31f98-028f-442b-9b26-11ee16e93fe5","resolution":{"observed_at":"2026-08-02T02:00:26.840373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/0894439313512975","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Social Science Computer Review 32(3), 279–294 (2014), https: //doi.org/10.1177/0894439313512975 Step-Level Preference Learning for Generative Agents 15","venue":"Social Science Computer Review","work_id":"89931f36-8b76-44b7-82fe-65ba727299be","year":2014},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:26.947683Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:14b0078f06c741d964fa2481934738a46b0fd650a231ded65b685426041b02f3","observation_id":"a5dab734-5889-4aa6-a907-ec0c3290924c","resolution":{"observed_at":"2026-08-02T02:04:24.129156Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11555","last_updated":"2025-02-17T08:40:30Z","snapshot_observed_at":"2026-08-16T12:57:49.810025Z","submitted_at":"2025-02-17T08:40:30Z","title":"Equilibrate RLHF: Towards Balancing Helpfulness-Safety Trade-off in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11555","snapshot_observed_at":"2026-08-02T02:00:27.047005Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.047005Z"},"links":{"cited_paper":"/paper/2502.11555","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:9a9fa82c9fa1d5b91dd7dd5c22009d1fc4f79a23d51ac60a0d297927750eddcb","observation_id":"ea5e864e-2ead-43bb-b4dd-4462626b34ad","resolution":{"observed_at":"2026-08-02T02:00:27.047005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:27.168170Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.168170Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:14d38bea84aa47bba8c8a0a32ca79edfb58128d25d04c2429c1dc3ba6dd8813b","observation_id":"d33aeea6-a77d-4cbf-ae70-bc78a1bcfeed","resolution":{"observed_at":"2026-08-02T02:00:27.168170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10147","last_updated":"2025-09-12T11:20:11Z","snapshot_observed_at":"2026-08-16T07:27:01.460052Z","submitted_at":"2025-09-12T11:20:11Z","title":"Virtual Agent Economies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10147","snapshot_observed_at":"2026-08-02T02:00:27.290597Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.290597Z"},"links":{"cited_paper":"/paper/2509.10147","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:d52f456f9e12adae246a9f7db8ec4ec23b802dfa626adf874a337fb9c2cd5d39","observation_id":"71db9729-c50a-40fe-aea3-10b382017ec3","resolution":{"observed_at":"2026-08-02T02:00:27.290597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07581","last_updated":"2025-08-26T08:03:56Z","snapshot_observed_at":"2026-08-18T16:40:09.622522Z","submitted_at":"2025-05-12T14:05:17Z","title":"YuLan-OneSim: Towards the Next Generation of Social Simulator with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07581","snapshot_observed_at":"2026-08-02T02:00:27.380205Z","title":"org/abs/2505.07581","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.380205Z"},"links":{"cited_paper":"/paper/2505.07581","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:e59409d4e3bc4e7a75a7854ca294193c46defc06a8129f325e9c45ab499a3d63","observation_id":"6e051ffa-f49c-4321-9d5b-591839c9cde1","resolution":{"observed_at":"2026-08-02T02:00:27.380205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06435","last_updated":"2025-09-11T06:00:29Z","snapshot_observed_at":"2026-08-18T03:06:12.937539Z","submitted_at":"2024-12-09T12:21:20Z","title":"Simulating Human-like Daily Activities with Desire-driven Autonomy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06435","snapshot_observed_at":"2026-08-02T02:00:27.464030Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.464030Z"},"links":{"cited_paper":"/paper/2412.06435","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:cb782e237648cf166c4c531411af45ed50dbbc21638090d5cd0e0c1089085700","observation_id":"26cca0a9-75b7-4fb6-85ce-b6c2de0a21b8","resolution":{"observed_at":"2026-08-02T02:00:27.464030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05418","last_updated":"2023-10-09T05:30:42Z","snapshot_observed_at":"2026-08-19T05:44:33.440021Z","submitted_at":"2023-10-09T05:30:42Z","title":"Humanoid Agents: Platform for Simulating Human-like Generative Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05418","snapshot_observed_at":"2026-08-02T02:00:27.546333Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.546333Z"},"links":{"cited_paper":"/paper/2310.05418","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:07c1f3fcc62a172c8ccfeadd786152f678c78f0e21d020b1ffc02289582f5fa1","observation_id":"2304d4a2-2f3a-460f-8b0d-98cd73635185","resolution":{"observed_at":"2026-08-02T02:00:27.546333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08673","last_updated":"2024-06-12T22:28:08Z","snapshot_observed_at":"2026-08-16T13:43:33.392971Z","submitted_at":"2024-06-12T22:28:08Z","title":"HelpSteer2: Open-source dataset for training top-performing reward models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08673","snapshot_observed_at":"2026-08-02T02:00:27.655165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.655165Z"},"links":{"cited_paper":"/paper/2406.08673","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:126fade18dd693977f3965e9b82470813a911e6405447d4eaa8ad176a71fb9a3","observation_id":"26726097-ee01-4fec-bbb3-dc053c65c315","resolution":{"observed_at":"2026-08-02T02:00:27.655165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:27.715565Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.715565Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:88a9f26f2accba9cd33816da1ba843aa8f11bb84da52762279480c8b67e6f789","observation_id":"d143ffa1-4a63-48fa-a809-59c57be3c424","resolution":{"observed_at":"2026-08-02T02:00:27.715565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-02T02:00:27.769416Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.769416Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:d34cf67fb9a4b68008e2fb2977160d90ee81fe70306ecc1b2c344531d97346d2","observation_id":"5e1418ec-fb4f-4d95-800e-9aad02d31ecd","resolution":{"observed_at":"2026-08-02T02:00:27.769416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:00:27.846388Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.846388Z"},"links":{"citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:676f59a2766fe547f61448426ace034fcc79ed53405882e6c78d4bc062d67229","observation_id":"729c0d4e-b098-4625-b815-1e0868fe633f","resolution":{"observed_at":"2026-08-02T02:00:27.846388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02053","last_updated":"2024-08-28T04:04:45Z","snapshot_observed_at":"2026-08-16T14:21:55.195670Z","submitted_at":"2024-02-03T06:16:28Z","title":"Affordable Generative Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02053","snapshot_observed_at":"2026-08-02T02:00:27.934581Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:27.934581Z"},"links":{"cited_paper":"/paper/2402.02053","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:005bfc0532f35a6031cdd59437eb3bff55d3c0c9ceff7d6dc8a55380a60282be","observation_id":"e1d5684d-909d-401a-86b3-f231d45d866c","resolution":{"observed_at":"2026-08-02T02:00:27.934581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14228","last_updated":"2025-03-10T02:42:01Z","snapshot_observed_at":"2026-08-16T13:41:08.794281Z","submitted_at":"2024-06-20T11:49:23Z","title":"EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14228","snapshot_observed_at":"2026-08-02T02:00:28.010591Z","title":"org/abs/2406.14228 Appendix A Interface Illustration Fig","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T02:00:28.010591Z"},"links":{"cited_paper":"/paper/2406.14228","citing_paper":"/paper/2607.14485"},"observation_digest":"sha256:6187d36330f38d4c7ff06c436ea5c4b40a87679f8f80b217af8561eb572ced99","observation_id":"829305f3-b6e1-42dc-9075-d7bee214b19b","resolution":{"observed_at":"2026-08-02T02:00:28.010591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14485","last_updated":"2026-07-16T01:58:53Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T12:18:51.533898Z","submitted_at":"2026-07-16T01:58:53Z","title":"Step-Level Preference Learning for Generative Agents in Social Simulations"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2607.14485."}