{"as_of":"2026-08-06T13:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea90075c83fd199277491a6be76975a30cc3087e8a8589531aca3db672f07140","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T17:29:13.549559Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.04831/citation-record","integrity":"/paper/2605.04831/integrity","json":"/paper/2605.04831/citation-record.json","paper":"/paper/2605.04831"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:703e048e4231e9a214d7281ee39d09626fc0cc9d769b8a1817da95d724adb419","observation_id":"c4aeeda9-41e4-459a-aeca-3db13a84a09d","resolution":{"observed_at":"2026-05-11T17:31:07.710832Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:753948ed4ff2779831110c866097c244ac03eadb17f3f1832db8bb413c23f13e","observation_id":"4470974a-34f7-43ee-b112-b21e7bfb9516","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Internlm2 technical report","venue":null,"work_id":"7acf2f38-80b4-4b65-9130-05e4d8a863b8","year":2026},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:df88a3ddc809cc421b2a703ebae3a651b8439370a3cb467fb31dca90ce101dbc","observation_id":"c9f39f89-3136-4683-bdd5-23b2544041dd","resolution":{"observed_at":"2026-05-26T07:31:54.393749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:61bc7bb3e611e44734a7cef61b20c92a3994939d297df1f92f359c0d6c9eb810","observation_id":"c777bfe9-a4be-4265-a37a-5f570e73b893","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14556","last_updated":"2024-03-08T05:20:08Z","snapshot_observed_at":"2026-07-06T16:23:34.422580Z","submitted_at":"2023-09-25T22:02:46Z","title":"Art or Artifice? Large Language Models and the False Promise of Creativity","version":3},"cited_work":{"arxiv_id":"2309.14556","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14556","snapshot_observed_at":"2026-07-04T19:50:09.947645Z","title":"Tuhin Chakrabarty, Philippe Laban, and Chien-Sheng Wu","venue":null,"work_id":"ab8760d0-bd0f-4d9f-b25b-7904ba7740f5","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2309.14556","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:39f48b3d16e7700501c9f75c8d4d7624c03073a930688b2c45a52d7d3236ff86","observation_id":"4eb4a61e-6176-4902-a679-4567c307a6bf","resolution":{"observed_at":"2026-05-11T17:31:07.697760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:ce933f541b9713cdd09c3bcbdc47bb48b66970a0fe0ff03a97b12678e897af8f","observation_id":"ca838c40-d0b6-4acf-8f06-b74ce318836a","resolution":{"observed_at":"2026-05-11T17:31:07.632449Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7b9f0ebc-075e-495d-9cc6-7cc51cb99cb0","year":2026},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:6a970164e5b32e499ea03d2b295dd92be4598d43b208af17d80022ee3a2ee77f","observation_id":"44308e25-bf3c-42a2-9ee0-74d2420366a5","resolution":{"observed_at":"2026-05-26T07:31:54.409930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:b73265974ba5a3fd0619347943c7f2f4948078bd82c481bbd041cad42987437d","observation_id":"66cb0e6f-ee34-4fe3-812d-1d360a9c53c1","resolution":{"observed_at":"2026-05-11T17:31:07.586556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10164","last_updated":"2024-09-16T10:54:04Z","snapshot_observed_at":"2026-07-06T19:15:56.947205Z","submitted_at":"2024-09-16T10:54:04Z","title":"Quantile Regression for Distributional Reward Models in RLHF","version":1},"cited_work":{"arxiv_id":"2409.10164","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.10164","snapshot_observed_at":"2026-07-03T00:27:29.852309Z","title":"Wei Geng, Baidi Xiao, Rongpeng Li, Ning Wei, Dong Wang, and Zhifeng Zhao","venue":null,"work_id":"802d29bf-d523-4efe-bcff-fff7014e60ca","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2409.10164","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:b887a1b284edbcd6a7a7d610ec7296deb0c9865b148edc64c4c1b2f449a465aa","observation_id":"af1524c6-ab14-47d6-980b-fc1416bfd25c","resolution":{"observed_at":"2026-05-11T17:31:07.636900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p18-1082","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/P18-1082","venue":null,"work_id":"c375569a-4c17-4018-9dce-9e14337bd47a","year":2018},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:d192ac917af08e5d21f2284ab2f5014ab514ac84df89a653f926ababaeb60d0a","observation_id":"372f4f43-56ab-4385-95fe-1cb073ade821","resolution":{"observed_at":"2026-05-08T20:04:06.362625Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-17T21:20:54.696683+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T21:20:54.696683+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1254","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/P19-1254","venue":null,"work_id":"d8f9777d-90e6-42e7-9fc0-fe97812252c8","year":null},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:15d53c3a173bae29b2365cf41ffda112680e55446cba81586f85b051899e6ae0","observation_id":"a7091523-85e3-40af-b421-808381a42604","resolution":{"observed_at":"2026-05-08T20:04:06.357792Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00769","last_updated":"2025-07-01T14:10:36Z","snapshot_observed_at":"2026-07-06T21:50:30.825536Z","submitted_at":"2025-07-01T14:10:36Z","title":"LitBench: A Benchmark and Dataset for Reliable Evaluation of Creative Writing","version":1},"cited_work":{"arxiv_id":"2507.00769","doi":"10.48550/arxiv.2507.00769","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00769","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jack Grieve","venue":"ArXiv.org","work_id":"aa286d0c-46f7-482b-a992-959dbb5b1202","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2507.00769","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:b1b50f59cc8ceb3a80a11ddb70e3ae3b3e1894d5fb7030ab9ea7789216adbee2","observation_id":"1ce6660c-0d80-466f-b9e7-3c2317bc2b09","resolution":{"observed_at":"2026-05-11T17:31:07.707466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02603","last_updated":"2025-03-14T17:09:03Z","snapshot_observed_at":"2026-07-06T19:27:07.844117Z","submitted_at":"2024-10-03T15:44:42Z","title":"Agents' Room: Narrative Generation through Multi-step Collaboration","version":2},"cited_work":{"arxiv_id":"2410.02603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02603","snapshot_observed_at":"2026-06-29T13:23:27.981328Z","title":"Agents’ room: Narrative generation through multi-step collaboration","venue":null,"work_id":"0eaa8ec9-b113-4b68-a24d-ccd32219a635","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2410.02603","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:69d1b03939cb90b9e4b819ff55a172ac30c8996215beb275262018f1a8d5a442","observation_id":"adbd8193-fb2b-4579-9161-4e272d7230c7","resolution":{"observed_at":"2026-05-11T17:31:07.718648Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00103","last_updated":"2025-06-11T14:56:19Z","snapshot_observed_at":"2026-08-02T19:05:32.884019Z","submitted_at":"2025-05-30T14:34:57Z","title":"Writing-Zero: Bridge the Gap Between Non-verifiable Tasks and Verifiable Rewards","version":2},"cited_work":{"arxiv_id":"2506.00103","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00103","snapshot_observed_at":"2026-07-10T09:26:59.706507Z","title":"Ezra Karger, Houtan Bastani, Chen Yueh-Han, Zachary Jacobs, Danny Halawi, Fred Zhang, and Philip E","venue":"cs.CL","work_id":"9ec3e1cc-d38c-4160-88d8-bfcd0d34e69c","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2506.00103","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:dba1666f5cee71f2a615fbf9a739a5701aa9870c1d861a6e660276cb5ad15689","observation_id":"b63bc4bd-f052-4cd4-91f5-794ae6c39385","resolution":{"observed_at":"2026-05-11T17:31:07.655332Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"stable/2332226","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:39:04.534389Z","title":"http://www.jstor.org/ stable/2332226","venue":null,"work_id":"146fa500-f9dd-40d3-9772-91d3c1f12f43","year":1938},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:6c5eb47ae00d0ff3efdaba0ce2a8e2b2eaef1414818129f41ffa42be2d89da6e","observation_id":"7789fe3b-b0e0-4c0d-8494-b1bc33839093","resolution":{"observed_at":"2026-05-11T17:31:07.687421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13919","last_updated":"2025-02-23T15:24:45Z","snapshot_observed_at":"2026-07-06T18:03:29.074967Z","submitted_at":"2024-04-22T06:57:43Z","title":"Navigating the Path of Writing: Outline-guided Text Generation with Large Language Models","version":2},"cited_work":{"arxiv_id":"2404.13919","doi":"10.48550/arxiv.2404.13919","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.13919","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2404.13919 , year =","venue":"arXiv (Cornell University)","work_id":"01eae97a-7156-4103-9eed-ff972c3eae80","year":2026},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2404.13919","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:d2b10cedd90f72c381d5432344ac8d7786ad06c689a04649d5a7e3cb5f08e8d0","observation_id":"e5d0f684-d099-42a4-9e30-f69e41c108d7","resolution":{"observed_at":"2026-05-11T17:31:07.660380Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":"2410.18451","doi":"10.48550/arxiv.2410.18451","metadata_source":"pith","pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","venue":"cs.AI","work_id":"141992ea-4174-463c-be4a-add6252bde93","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:5d1c7feb4064a57be6b6aecadb9fb304d19db32eb422a679d9810d09b8bc63c2","observation_id":"08081211-5261-4700-b9c9-0904304f7abe","resolution":{"observed_at":"2026-05-17T16:18:01.701777Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05690","last_updated":"2024-06-09T08:31:14Z","snapshot_observed_at":"2026-07-06T18:27:41.409205Z","submitted_at":"2024-06-09T08:31:14Z","title":"MoPS: Modular Story Premise Synthesis for Open-Ended Automatic Story Generation","version":1},"cited_work":{"arxiv_id":"2406.05690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.05690","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ca35e4bf-55f1-40c6-ad72-0381aa63c83c","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2406.05690","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:7bc44d93e8307408ffd1482f2bc0522755f403adcfcb4e1d0ddb076625e882bd","observation_id":"095bb39a-a64e-430f-a6b8-04a04abbd3d0","resolution":{"observed_at":"2026-05-11T17:31:07.571420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed: 2025-02-04","venue":null,"work_id":"3802f46e-8e6e-4f14-af22-2281bf04e06b","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:0755160c772a4a2942637c2565784819e31c7f845df7f7ff2eb56d442b1ce429","observation_id":"c7283e2f-061c-46fe-b0d6-5114ffd7cdc7","resolution":{"observed_at":"2026-05-26T07:31:54.396877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06281","last_updated":"2024-01-03T12:20:35Z","snapshot_observed_at":"2026-08-06T08:22:38.908366Z","submitted_at":"2023-12-11T10:35:32Z","title":"EQ-Bench: An Emotional Intelligence Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":"2312.06281","doi":"10.48550/arxiv.2312.06281","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06281","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"month = jan, year =","venue":"arXiv (Cornell University)","work_id":"c9557a9b-a95a-40e0-8876-f8d518f5b0db","year":2023},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2312.06281","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:10bae087d2b86d73f738dcde2debc8f45947d75c7aba364e1c63617faec417be","observation_id":"47a6c24c-a290-4a22-a5e7-524cdcc21293","resolution":{"observed_at":"2026-05-11T17:31:07.621013Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T06:23:38.539556+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T06:23:38.539556+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19328","last_updated":"2025-02-26T17:19:12Z","snapshot_observed_at":"2026-07-06T20:43:08.913991Z","submitted_at":"2025-02-26T17:19:12Z","title":"Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems","version":1},"cited_work":{"arxiv_id":"2502.19328","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19328","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agentic reward modeling: Integrating human preferences with verifiable correctness signals for reliable reward systems","venue":null,"work_id":"533be534-90a2-4753-8b83-2c71a9068e10","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2502.19328","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:5cc325196a5a109acdf007cabdcadf119ccec3bbb06803f7a5d9cf1e315552df","observation_id":"8189beed-aa38-406d-96fc-d76ca7036d29","resolution":{"observed_at":"2026-05-11T17:31:07.649828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24175","last_updated":"2025-04-29T15:38:34Z","snapshot_observed_at":"2026-08-02T16:30:12.042383Z","submitted_at":"2024-10-31T17:42:26Z","title":"Constraint Back-translation Improves Complex Instruction Following of Large Language Models","version":2},"cited_work":{"arxiv_id":"2410.24175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.24175","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Constraint back-translation improves complex instruction following of large language models.arXiv preprint arXiv:2410.24175","venue":null,"work_id":"09236a67-14fc-435e-ba4a-d8bfa9f75310","year":null},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2410.24175","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:d947799c84a98de336463e4cb6784c8130dbcbcd3f7a7fefdefc70a628e88c00","observation_id":"6d1f5932-d9df-4b65-8943-72d3991e93ce","resolution":{"observed_at":"2026-05-11T17:31:07.693503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:b060e830040486dbc475cfbaac0fc22f487fcb51c730372e0d82c41b0da234b7","observation_id":"74bd643a-8e73-48be-be89-e8b3f2e1e1e3","resolution":{"observed_at":"2026-05-11T17:31:07.672332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Verbosity bias in preference labeling by large language models","venue":null,"work_id":"8cbeccfc-9e8b-430a-87b0-30e1de0c04bf","year":2023},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:64805c984fae4ce0950d92bc799343769b7039b302916b84e1efe80bb5f49424","observation_id":"de41791b-ffe1-4414-9954-905a05f08121","resolution":{"observed_at":"2026-05-26T07:31:54.399925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:f478ca724103a1b6a78583860fba4634a814aab231f03e38ed0cf27cf26df257","observation_id":"77bf7f07-dc8a-4a41-8fdf-9904ae9f6240","resolution":{"observed_at":"2026-05-11T17:50:08.654972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17667","last_updated":"2025-05-27T09:39:47Z","snapshot_observed_at":"2026-07-06T21:29:11.652211Z","submitted_at":"2025-05-23T09:31:55Z","title":"QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17667","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17667","snapshot_observed_at":"2026-07-03T13:28:18.208570Z","title":"Qwenlong-l1: Towards long-context large reasoning models with reinforcement learning","venue":null,"work_id":"5eb4668b-c05a-469e-87fa-d57ca82bfefb","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2505.17667","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:408b35d9f6e3b0e876b63cb8ba7a5712eea8c022530260e7ad36165ce9a9b530","observation_id":"6e5e2916-47b9-4935-9b3a-d04314fb4766","resolution":{"observed_at":"2026-05-11T17:31:07.683022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00554","last_updated":"2024-07-19T22:50:46Z","snapshot_observed_at":"2026-08-02T00:45:03.127158Z","submitted_at":"2024-06-01T21:14:25Z","title":"Guiding and Diversifying LLM-Based Story Generation via Answer Set Programming","version":2},"cited_work":{"arxiv_id":"2406.00554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.00554","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qianyue Wang, Jinwu Hu, Zhengping Li, Yufeng Wang, daiyuan li, Yu Hu, and Mingkui Tan","venue":null,"work_id":"507ae817-ac80-4ea8-b57e-0776a1f716ed","year":null},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2406.00554","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:e70de61a56aedfc7d7191920d41dce845898b66b4fa4bf1d6c38562b77ee71b7","observation_id":"9a898a52-06e2-452b-a3c0-51e513f114e0","resolution":{"observed_at":"2026-05-11T17:31:07.552951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grok (version 2025-09-14)","venue":null,"work_id":"be116e35-cbc8-4cc2-a96b-f1881cd79cba","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:c62e9c28a60a91023ca73cd63b01c5ec9569419c7646363115d0f5af937d113c","observation_id":"54a72acd-d1a8-44c9-b963-254fe5357a45","resolution":{"observed_at":"2026-05-26T07:31:54.388271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16445","last_updated":"2025-06-19T16:26:58Z","snapshot_observed_at":"2026-08-04T01:42:43.061948Z","submitted_at":"2025-06-19T16:26:58Z","title":"StoryWriter: A Multi-Agent Framework for Long Story Generation","version":1},"cited_work":{"arxiv_id":"2506.16445","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16445","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language model","venue":null,"work_id":"759d95e1-64de-48e1-a7ee-18d0705a415b","year":null},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2506.16445","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:71cd515de5663945588b8139eb4352cf11008022bb0251a10d9b2ba8f5dcf542","observation_id":"c58090b1-def5-481d-8983-2a992cc12670","resolution":{"observed_at":"2026-05-11T17:31:07.663724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00451","last_updated":"2024-06-17T22:11:49Z","snapshot_observed_at":"2026-07-06T18:08:09.361079Z","submitted_at":"2024-05-01T11:10:24Z","title":"Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":"2405.00451","doi":"10.48550/arxiv.2405.00451","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00451","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"P., Kawaguchi, K., and Shieh, M","venue":"arXiv (Cornell University)","work_id":"c32202fe-3b76-413d-8db1-885ff3480fe6","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2405.00451","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:a68e6d7631879b4373f51f3bccb2f595debfa098b4787720cb634cc00776dd53","observation_id":"68714fb5-68aa-476d-9c59-4a3b6fff7f38","resolution":{"observed_at":"2026-05-11T17:31:07.625809Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3 technical report","venue":null,"work_id":"af8551b6-97b4-45b5-9376-da301ff915fc","year":2026},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:0118558ee60d41bb7191ff7e24f07a18066dc2045716c543cc2f6c2c99a329ae","observation_id":"a3a564ad-2141-44d4-aaad-5bc368c63ae0","resolution":{"observed_at":"2026-05-26T07:31:54.390851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:2c11e553515830a54e90e4108d914f6fc5a4ab49075c1cdad62ba21b9da3e45f","observation_id":"20f00639-504e-4917-bf06-baef71e7a0cb","resolution":{"observed_at":"2026-05-11T17:31:07.609349Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12328","last_updated":"2025-04-12T16:07:36Z","snapshot_observed_at":"2026-07-06T21:10:31.989050Z","submitted_at":"2025-04-12T16:07:36Z","title":"A Comprehensive Survey of Reward Models: Taxonomy, Applications, Challenges, and Future","version":1},"cited_work":{"arxiv_id":"2504.12328","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.12328","snapshot_observed_at":"2026-07-02T05:46:41.076602Z","title":"A comprehensive survey of reward models: Taxonomy, applications, challenges, and future","venue":null,"work_id":"66d2bc8c-9efa-4c86-b7b3-262ebc90877f","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2504.12328","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:f7a71e1b1d3f6dbcc857a0e983565c780ec122ef0ba7d0bf7269b8607cbb73fb","observation_id":"b80ce6e4-1d60-4892-af25-9ed48cca04e3","resolution":{"observed_at":"2026-05-11T17:31:07.645525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"a scientist proposes a theorem proving that free will is an illusion and faces backlash from multiple sides","venue":null,"work_id":"df18e126-e510-4fad-8b81-1bbd3415e2f6","year":2026},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:c5fb680f50f0a3a92a1f704ac764fb1f4cda63ddfd84ccb830d8c427646f81a4","observation_id":"8ed93a61-1fcb-49c1-898d-60526c82308f","resolution":{"observed_at":"2026-05-26T07:31:54.382520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2aa060ab-bf2e-466d-b8ca-cc311696c78a","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:bf82a6e667f80cdfced8f77ef01fdf296c2bab5b139e329cc93274765f2f4979","observation_id":"46947e5d-5615-49b3-afea-b32f98d62c56","resolution":{"observed_at":"2026-05-26T07:31:54.406515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On one hand we prompt larger LLMs to evaluate two stories generated by smaller LLMs, on the other hand we compare a story from a larger LLM with a story from a smaller LLM","venue":null,"work_id":"91ec2551-b32a-4579-bbec-ae31439baa3f","year":2025},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:26ccda385c303961497873eb898fe612f6c1f5782bebf2229ae6c82689b4d7c3","observation_id":"722c1558-e90a-44dd-8249-295671a28d03","resolution":{"observed_at":"2026-05-26T07:31:54.379308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a4d2d09d-8a4c-461a-a772-c553ca4aa6b1","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:ab857553edddc27b4d4947ed26c6cb871672c88017f877d9712e6db802cbaf11","observation_id":"8b801b60-4747-4e37-84a5-512980f90c76","resolution":{"observed_at":"2026-05-26T07:31:54.385620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"“Tie” means both models select the same story","venue":null,"work_id":"5f1bf881-e148-43cc-bdf1-1bebc15189a9","year":2026},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:bde1e227dcab732be6e6c713a6abbcd5226c5096a4cf1ac91bc58dc06b5ef060","observation_id":"81d6a349-98ca-4c51-bb53-6012c2753c8f","resolution":{"observed_at":"2026-05-26T07:31:54.403301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"(-) Premise Back-generation","venue":null,"work_id":"1b14732a-cadc-4756-9fc9-331b288c8367","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:f6568b238abb976942f8ed5e8a78c03a0582b123b5c50fda39d2867bc3dd86c3","observation_id":"7d5f7925-951c-4f11-8522-1233a7425964","resolution":{"observed_at":"2026-05-26T07:31:54.373059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H.4 LINGUISTICANALYSIS We conduct linguistic analysis on stories selected by different reward models","venue":null,"work_id":"ab1227c0-e0c4-4745-a6e6-6880588fb7f6","year":1995},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:7eee97a8818f9cff6853d46e45a98f62b107314f9e3bc9c9945da833cd556ba7","observation_id":"b7788b1e-c191-4e2c-b2f4-d5416d0adb42","resolution":{"observed_at":"2026-05-26T07:31:54.367646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Difference","venue":null,"work_id":"bb8c05d3-6925-4379-a00d-80d33dfaf983","year":2026},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:5dbac0e5c066e5e04888b67b8489209a020f450c9f91d854170e34352f35aaf6","observation_id":"d6dafab6-ba94-4304-8e4e-2298b46eb0a2","resolution":{"observed_at":"2026-05-26T07:31:54.370206Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e0b5569c-9a67-4a73-9f46-3e1195ec860c","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:59040852e4dc16dab1a31049c7bbc62ff2c9a6ca70c964f75d9a6b770a25cc28","observation_id":"59652d13-0c43-48f5-a949-2e3ffb5b38b6","resolution":{"observed_at":"2026-05-26T07:31:54.375812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":11,"parse_uncertain":0,"unresolved":4,"verified_exact":16,"verified_fuzzy":10},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2605.04831."}