{"as_of":"2026-08-07T21:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e5fed820d42c28f741c872c2f7976635a4514370def66ee2696d782317907f34","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:49:49.180444Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:38:50.313305Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:46:14.342643Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"cited_work":{"arxiv_id":"2506.16024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16024","snapshot_observed_at":"2026-07-01T20:46:14.342643Z","title":"From general to targeted rewards: Surpassing gpt-4 in open-ended long-context generation","venue":null,"work_id":"caf06441-d279-4310-b2b9-8064bda8ddc5","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":176,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2506.16024","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:35b2fb1eb785b43bfb6958c579553331a99275f5ac0e73c78bbd427224632a50","observation_id":"30c3a4b0-31ad-41ca-941c-9751ccf1f351","resolution":{"observed_at":"2026-05-18T00:05:31.664012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"cited_work":{"arxiv_id":"2506.16024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16024","snapshot_observed_at":"2026-07-01T20:46:14.342643Z","title":"From general to targeted rewards: Surpassing gpt-4 in open-ended long-context generation","venue":null,"work_id":"caf06441-d279-4310-b2b9-8064bda8ddc5","year":2025},"citing_paper":{"arxiv_id":"2605.07465","last_updated":"2026-05-08T09:13:12Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:13:12Z","title":"SEIF: Self-Evolving Reinforcement Learning for Instruction Following","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:51:09.514927Z"},"links":{"cited_paper":"/paper/2506.16024","citing_paper":"/paper/2605.07465"},"observation_digest":"sha256:478b829a9d68accc1c6754b04548f5ec9ccfff3b39173279efcb2c879350575a","observation_id":"2130b475-363d-4d1c-8fd9-220de7dafc4d","resolution":{"observed_at":"2026-05-11T04:20:55.949246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"cited_work":{"arxiv_id":"2506.16024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16024","snapshot_observed_at":"2026-07-01T20:46:14.342643Z","title":"From general to targeted rewards: Surpassing gpt-4 in open-ended long-context generation","venue":null,"work_id":"caf06441-d279-4310-b2b9-8064bda8ddc5","year":2025},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2506.16024","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:8811412c3e75dfce880458fcfced3eb6d4d28d7638034640578ea69f73830fad","observation_id":"6c6922a7-4223-4a49-87bf-676531d8ee2e","resolution":{"observed_at":"2026-07-01T20:46:14.343964Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.16024/citation-record","integrity":"/paper/2506.16024/integrity","json":"/paper/2506.16024/citation-record.json","paper":"/paper/2506.16024"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.324850Z","title":null,"venue":null,"work_id":"2a0ca6f6-429b-45a2-beb2-9c3be9495233","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.699129Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:3ad76e64b0ce99c83ea56e7d43690cbae771ce44c9295e4800240e650eea4dd3","observation_id":"b9f414b3-ef0a-4c8a-b75f-41f8bef65d7d","resolution":{"observed_at":"2026-08-06T23:49:54.408301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-04T21:07:04.238345Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-06T23:49:43.738491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.738491Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:2db026228feea873e8b0269661a2ac0891d75ae1790e92f43c1eb328b45ff428","observation_id":"8cef63ee-899a-4c2a-a768-7c7e7237abcf","resolution":{"observed_at":"2026-08-06T23:49:43.738491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.128295Z","title":null,"venue":null,"work_id":"f740d991-afc7-43a7-a6a2-76811c8723c0","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.814403Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:3e455fed4f5b4ca8494d818f5ca78c49b58b84ee30e3f0351c1518e3f0ea2eae","observation_id":"2e556eaf-749a-4e32-bb5e-5633c28f2cb8","resolution":{"observed_at":"2026-08-06T23:49:54.237578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07055","last_updated":"2024-08-13T17:46:12Z","snapshot_observed_at":"2026-07-06T19:00:17.992934Z","submitted_at":"2024-08-13T17:46:12Z","title":"LongWriter: Unleashing 10,000+ Word Generation from Long Context LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07055","snapshot_observed_at":"2026-08-06T23:49:43.860165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.860165Z"},"links":{"cited_paper":"/paper/2408.07055","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:7ccf1d1fb7db93f537c444fdd3bd76b3f52ea6df99f8fd7d379fbcb2aec28238","observation_id":"2c265f62-e1ab-424a-ae77-ee52b5c3ca48","resolution":{"observed_at":"2026-08-06T23:49:43.860165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.006395Z","title":null,"venue":null,"work_id":"773a6ec9-52d8-43bf-abdc-deebded9c447","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.907794Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:9d39e7f9ff8a75a2d3d42d32b89fd7c9c48b0c7d046e34c0e8a68939ce45df3b","observation_id":"236c8de7-949f-42ca-afef-dbfbce19af36","resolution":{"observed_at":"2026-08-06T23:49:54.052816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.022270Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.022270Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:05f65af578aefd9aa5bd6820d8f0bbff99828bb3354e0fc600e8763db23e43b9","observation_id":"4d36f76e-7a00-4171-a2b9-2da1305902de","resolution":{"observed_at":"2026-08-06T23:49:44.022270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.120598Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.120598Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:09254782d7d5992cc3d641e207b16e96cf92ce05ace5409a11f39145811dcf38","observation_id":"5f8acf18-99c1-4c75-817f-aa49b9edf5f5","resolution":{"observed_at":"2026-08-06T23:49:44.120598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.272093Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.272093Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:847dc71b45f727e3e2559ad6deaf01d69083c3f18bd33ec8bd87804ceb43e64a","observation_id":"5f68243e-48e3-4e26-b3b3-ef1c2eeadc7c","resolution":{"observed_at":"2026-08-06T23:49:44.272093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-06T23:49:44.314588Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.314588Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:6a0509287218ead8b627fb05b57718b66e0ee25c455e9240c431ea5bcacc9acf","observation_id":"5f09216f-3f4f-4346-8399-c217cdace7bf","resolution":{"observed_at":"2026-08-06T23:49:44.314588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.809291Z","title":null,"venue":null,"work_id":"e2394ca6-0530-48a6-a15a-20936bca497e","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.329946Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:00fe39b1006fd4534236b2c1d8bb5d55a2971888458c5b5c8c9d3d550a52a358","observation_id":"4417de2c-c90c-4496-8e18-b2eb200b88d8","resolution":{"observed_at":"2026-08-06T23:49:53.894572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.633630Z","title":null,"venue":null,"work_id":"ec303062-bed2-4f9e-9c8e-9e7ef2a948fc","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.396554Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:9d6e69b134207346ecccfb8b5a44170e04a0fb74395b8b8f7b570c19f72a2c59","observation_id":"5974bde4-aca8-44c4-92c9-6f0a835ffd91","resolution":{"observed_at":"2026-08-06T23:49:53.735912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.474187Z","title":null,"venue":null,"work_id":"8de52d57-16c4-407d-8c95-5c88146a2102","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.479076Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c47bc3c3f8eda9f67fb71cfb3a855f30db18ecddde9f8819b163a1fc5cc563dd","observation_id":"12cae417-0717-4ead-9967-196f7ce980de","resolution":{"observed_at":"2026-08-06T23:49:53.562496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02554","last_updated":"2023-04-05T16:17:32Z","snapshot_observed_at":"2026-08-06T05:29:37.931917Z","submitted_at":"2023-04-05T16:17:32Z","title":"Human-like Summarization Evaluation with ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02554","snapshot_observed_at":"2026-08-06T23:49:44.575596Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.575596Z"},"links":{"cited_paper":"/paper/2304.02554","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c1e2ba685e908d7593b04bd5ab42aa417594e401e67161e2237adbbad299d8f4","observation_id":"6d4cbf06-a589-4f36-8b55-fe83b1168291","resolution":{"observed_at":"2026-08-06T23:49:44.575596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T23:49:44.657266Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.657266Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:211c2c3384cf413d2ec747b8adc9c011e9c91d3da974f037759dedc225084f97","observation_id":"ee2d02a8-d372-4b79-83ea-5b07b22a068b","resolution":{"observed_at":"2026-08-06T23:49:44.657266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-06T23:49:44.770766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.770766Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:e52af62036246c5e174bd7f0a7d5935062258d800010aa2127b6b70e4f804ade","observation_id":"d7fb7a6a-2efb-44d7-b6cd-fb0a866d80fa","resolution":{"observed_at":"2026-08-06T23:49:44.770766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-06T23:49:44.861710Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.861710Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:cfec0febf0b7af60ade7e4ec226550e1635b29864cbb44eb35e17e9e0ffd2ad2","observation_id":"7477ff42-3194-405c-b262-185315e163df","resolution":{"observed_at":"2026-08-06T23:49:44.861710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:49:44.944982Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.944982Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:dfdde7e460e5c170c2eefe9d0d7c4a3952742e3d9361bf1b6fd1b0c0d4f3f239","observation_id":"7042a2e3-5ddb-4d6c-8f2a-26fb77cc0a4a","resolution":{"observed_at":"2026-08-06T23:49:44.944982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02490","last_updated":"2024-10-30T14:53:22Z","snapshot_observed_at":"2026-08-07T20:59:29.819833Z","submitted_at":"2024-07-02T17:59:56Z","title":"MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02490","snapshot_observed_at":"2026-08-06T23:49:45.021883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.021883Z"},"links":{"cited_paper":"/paper/2407.02490","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:294b2bb1259a65eec9c77c1fa7e6d1edf794e87329280effb27be8dab2ca9e4b","observation_id":"c35b17de-6ccc-4761-af96-722dbe43503c","resolution":{"observed_at":"2026-08-06T23:49:45.021883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-06T23:49:45.103956Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.103956Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:7f323fa087a5f4a3fef2cb5da24d788786e90d44cc627b487475346ff1e09455","observation_id":"529850c2-aedf-4374-af1a-c1af52d8c8fd","resolution":{"observed_at":"2026-08-06T23:49:45.103956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08460","last_updated":"2024-10-03T15:46:13Z","snapshot_observed_at":"2026-08-04T19:43:12.423655Z","submitted_at":"2023-04-17T17:36:35Z","title":"LongForm: Effective Instruction Tuning with Reverse Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08460","snapshot_observed_at":"2026-08-06T23:49:45.194684Z","title":"o ksal, Timo Schick, Anna Korhonen, and Hinrich Sch \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.194684Z"},"links":{"cited_paper":"/paper/2304.08460","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:6aad734398939d45f193e37b64d81b7eb7f650c92be710d7bd3970e844c1ccc3","observation_id":"34d087a0-cd4a-4e21-b2f9-d566fe2f35c2","resolution":{"observed_at":"2026-08-06T23:49:45.194684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.318152Z","title":null,"venue":null,"work_id":"d5b21bb4-a3a5-47a4-8306-fb33ab88cec2","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.242809Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c919fa3d8f459ff76798785400e7e70b76285f5e6e4c44a0b4ab68ec6aa24fe9","observation_id":"a5f31b34-4056-49a4-8c61-6cf39760e3e5","resolution":{"observed_at":"2026-08-06T23:49:53.402762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11016","last_updated":"2024-10-15T03:24:47Z","snapshot_observed_at":"2026-08-06T19:12:44.022988Z","submitted_at":"2024-06-27T01:52:05Z","title":"LongLaMP: A Benchmark for Personalized Long-form Text Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11016","snapshot_observed_at":"2026-08-06T23:49:45.315741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.315741Z"},"links":{"cited_paper":"/paper/2407.11016","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:39a00ccf884725a5e6ebf77cb024d3e71ee4a7e56bf9084b18a3df72aa4a8728","observation_id":"0d698436-d03b-4e13-a145-6c37421a7044","resolution":{"observed_at":"2026-08-06T23:49:45.315741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.149785Z","title":null,"venue":null,"work_id":"727f3f6b-bff1-493b-b66e-6d2d64289609","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.393122Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:968c4355ad8a1f8f497ca813669a9239887ad145d704a3ad7fd350cdefc5ebf5","observation_id":"c3c620a6-2120-4b1c-a9c2-a7dcadeb3e73","resolution":{"observed_at":"2026-08-06T23:49:53.216011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.961378Z","title":null,"venue":null,"work_id":"64f34224-117f-4c67-9749-f0059b66e8a5","year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.467796Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:4ae9cf3adfc26114b24f329847d65d6f09d02dfbdfa3c61c13576fa43622a994","observation_id":"0179e988-ab6e-43f0-92ac-1d417b699cf5","resolution":{"observed_at":"2026-08-06T23:49:53.054656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.826790Z","title":null,"venue":null,"work_id":"d481fcbc-9a52-44ef-8481-80891784834e","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.539371Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:2229ef439d783ff052ba09b286703dcaf4978b12fee89bf4fa9ae487d92d28c1","observation_id":"a4d8107f-edb6-4c45-b171-df8fd309b3d6","resolution":{"observed_at":"2026-08-06T23:49:52.915515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02060","last_updated":"2024-06-12T02:46:16Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T15:59:11Z","title":"Long-context LLMs Struggle with Long In-context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02060","snapshot_observed_at":"2026-08-06T23:49:45.617067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.617067Z"},"links":{"cited_paper":"/paper/2404.02060","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:085f21b8887e94b9f9158e4531bba67c2dc6a0da2f747529b5ae505ba0a0545a","observation_id":"dfa0033a-f9b9-48e1-b771-49d7b24b3522","resolution":{"observed_at":"2026-08-06T23:49:45.617067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.642494Z","title":null,"venue":null,"work_id":"d1667959-fd51-4592-98f7-9a7f2a7db714","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.687633Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ae0172f218e770e0cd4cf362b4b7f7ea823c68f07baaa33bb19994e04162ce8a","observation_id":"5c469c74-a5be-4097-ac07-bf4a99c668c9","resolution":{"observed_at":"2026-08-06T23:49:52.753067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.453704Z","title":null,"venue":null,"work_id":"03d596a3-13db-4354-b801-94cdd79f4f9a","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.739551Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:bc0e2a19116fb7f225e9ccfab3b81abac317f4932c550757de6688793b7152b6","observation_id":"88c43ae2-e0bf-4f22-a362-20ad6e67b8e9","resolution":{"observed_at":"2026-08-06T23:49:52.520620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:45.792936Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.792936Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ca6c2ee7b3470fb1aa9acd4392c6cb2e21a26d002e6dd4790edc85a617e5ee15","observation_id":"13afb7af-db6b-4057-8a33-5dd80c6b2a6e","resolution":{"observed_at":"2026-08-06T23:49:45.792936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:49:45.880835Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.880835Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:dc0709dcae724c050e08cd04d731450d85d85feab736e931113068c36168cd27","observation_id":"a6fe5f2d-6df3-4d70-a985-0738b2b35da9","resolution":{"observed_at":"2026-08-06T23:49:45.880835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:45.941061Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.941061Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:5e3a3ad6c976e563676d3218c04cbedb068f171d6656c54331fb2c2f7d35d9b7","observation_id":"830307c8-b165-4305-bbf1-ec2a4ef09ced","resolution":{"observed_at":"2026-08-06T23:49:45.941061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04199","last_updated":"2024-10-24T14:43:22Z","snapshot_observed_at":"2026-08-04T04:56:00.906905Z","submitted_at":"2024-10-05T15:33:25Z","title":"LongGenBench: Long-context Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04199","snapshot_observed_at":"2026-08-06T23:49:45.997697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.997697Z"},"links":{"cited_paper":"/paper/2410.04199","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:4cec0c7ad22491f5365b928f070ed8710dd7082f572cb70b15e8b1a81c69f52c","observation_id":"086c634b-f677-4d9c-8c9a-9cef0dbeb295","resolution":{"observed_at":"2026-08-06T23:49:45.997697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.307551Z","title":null,"venue":null,"work_id":"6f3f0096-a70e-4fb7-9548-6261fe5fcd71","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.093389Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:e0c779ac7c019194bc2ad6da22cc68488e581e0af370fcf50be47fcceb03f933","observation_id":"a592615a-3980-41cd-aced-ef607163ab2d","resolution":{"observed_at":"2026-08-06T23:49:52.378599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12630","last_updated":"2024-08-09T00:01:58Z","snapshot_observed_at":"2026-08-01T19:41:18.143605Z","submitted_at":"2024-05-21T09:33:31Z","title":"Exploration of Masked and Causal Language Modelling for Text Generation","version":2},"cited_work":{"arxiv_id":"2405.12630","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12630","snapshot_observed_at":"2026-08-06T23:49:49.670750Z","title":"Exploration of Masked and Causal Language Modelling for Text Generation","venue":"cs.CL","work_id":"3612a61f-abac-475b-abc0-201b7b98b6d8","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.175021Z"},"links":{"cited_paper":"/paper/2405.12630","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:23eead5a86e7b883f63478c05539f08f13e16f159ac943a5961b2d45556bafcb","observation_id":"a32eb9f3-2544-4fb3-8e49-00b627fadd6e","resolution":{"observed_at":"2026-08-06T23:49:49.759678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.164167Z","title":null,"venue":null,"work_id":"aebe3b45-6014-44e0-916e-f88ee363dff9","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.255452Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:a8ae6550fffbe18f853da1cbe405e745d1463485223809033ef59b26417b70d3","observation_id":"10dafc76-c9c9-4275-8617-cbff01502816","resolution":{"observed_at":"2026-08-06T23:49:52.222337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.041783Z","title":null,"venue":null,"work_id":"e24fe567-214d-4815-90a4-a9a5933d74da","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.319450Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ac7fadbf59f7fe6b15619f91f0d07f6fb864c2d4d3e2c172166e5097f393b295","observation_id":"f888ce7a-2b12-49b9-9897-b8e67fc92e8f","resolution":{"observed_at":"2026-08-06T23:49:52.074672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:46.383781Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.383781Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:a010fd5b44215065a52dff226f12a5bef7c2ce0abfb250ec2e1cc432b2d47b30","observation_id":"d63995fc-019c-46d9-9870-002206de8f2a","resolution":{"observed_at":"2026-08-06T23:49:46.383781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:46.451664Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.451664Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:4079ee2816a446303ca42754adfe50a094aaff5150fda82f4cfb07370d3771ad","observation_id":"d42f8e59-0122-4261-9780-078650f3b807","resolution":{"observed_at":"2026-08-06T23:49:46.451664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.900473Z","title":null,"venue":null,"work_id":"e3a250d3-803d-4a53-9fe9-545560fd987f","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.512069Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:6d9f0eef117f00c13b1245e9e83765a650fec5a803f3f9ce8d602d42a0c40681","observation_id":"92eb86ef-20e4-4d99-af77-27d2cbf87aca","resolution":{"observed_at":"2026-08-06T23:49:51.955371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19371","last_updated":"2024-10-02T01:01:57Z","snapshot_observed_at":"2026-08-04T05:09:34.544378Z","submitted_at":"2024-06-27T17:50:35Z","title":"Suri: Multi-constraint Instruction Following for Long-form Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19371","snapshot_observed_at":"2026-08-06T23:49:46.578703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.578703Z"},"links":{"cited_paper":"/paper/2406.19371","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:2e74fe31711f03ad3b9c2293a6dc90ecef1dd0186bb33426046db20e6a669403","observation_id":"12605ee8-c6ba-4fd6-9164-6c7aac2cafc5","resolution":{"observed_at":"2026-08-06T23:49:46.578703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.802626Z","title":null,"venue":null,"work_id":"bb343693-89eb-4d69-b4f8-30a4d009a267","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.677908Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ef340901fbd40f9056009db8eca64028403cd49d4fa7bd842e0da1b4a971d9fd","observation_id":"51abed4d-7cb7-4fb6-b823-3491463ad441","resolution":{"observed_at":"2026-08-06T23:49:51.856072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16191","last_updated":"2024-09-24T15:38:11Z","snapshot_observed_at":"2026-08-03T19:24:54.460507Z","submitted_at":"2024-09-24T15:38:11Z","title":"HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16191","snapshot_observed_at":"2026-08-06T23:49:46.777966Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.777966Z"},"links":{"cited_paper":"/paper/2409.16191","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:b24c67222f74f86b2cfa29a6abe0aeead110dee507b4fc810384bb6fa8d3ebec","observation_id":"61142bbc-84ef-42df-8c1f-b9fea274b958","resolution":{"observed_at":"2026-08-06T23:49:46.777966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:46.874265Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.874265Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:278089ac3fe2925d8045ab875c5c9bf96f3bb53f379173de6ff943f3e488a9c5","observation_id":"d6570b55-f2a4-4d3a-86ad-9cac1299f8aa","resolution":{"observed_at":"2026-08-06T23:49:46.874265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.570230Z","title":null,"venue":null,"work_id":"34492f2a-af97-4a6c-888d-095c1ffa6d5a","year":2017},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.997928Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:5c1327d174ef1d5f961412ef85ddfed1cbd2a2dc511bd8e6c03d4f0c0b6fc690","observation_id":"9eed7ccb-e89a-4efb-9ae5-7a14134382ce","resolution":{"observed_at":"2026-08-06T23:49:51.683561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:47.087005Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.087005Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:fe8aa71b203d16d98f23566ee1220fa25072c252b04b5b08a5acaeb7c18d5aba","observation_id":"40630c9e-4032-4943-8cbe-acfa5b8f5174","resolution":{"observed_at":"2026-08-06T23:49:47.087005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17492","last_updated":"2024-02-27T18:42:42Z","snapshot_observed_at":"2026-08-02T19:39:02.664535Z","submitted_at":"2023-06-30T09:07:37Z","title":"Preference Ranking Optimization for Human Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17492","snapshot_observed_at":"2026-08-06T23:49:47.131971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.131971Z"},"links":{"cited_paper":"/paper/2306.17492","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:395e1645212df1f53bcab19e6b2fe5d23dbbca3218b111db5525e81b793a00a4","observation_id":"5879515a-38ee-40e5-bfec-08e0afebe51f","resolution":{"observed_at":"2026-08-06T23:49:47.131971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.330646Z","title":null,"venue":null,"work_id":"e15162f4-2e6c-43e1-8e34-3f8f607a5026","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.192922Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:b5968db74564aa07e08845b266a154ce1868a8310623aa948fd28f65f8bcf933","observation_id":"d61cef29-e34b-401a-896f-fe36f61d1391","resolution":{"observed_at":"2026-08-06T23:49:51.412239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15042","last_updated":"2024-06-04T12:46:47Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T18:12:25Z","title":"PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models","version":4},"cited_work":{"arxiv_id":"2401.15042","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15042","snapshot_observed_at":"2026-08-06T23:49:49.372111Z","title":"PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models","venue":"cs.CL","work_id":"8117887d-9c79-49c3-a204-e8a5f24e8881","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.284775Z"},"links":{"cited_paper":"/paper/2401.15042","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:d7b940897576151a7710064ab4b97ecba28a1160079ec0e159eac1f183f030af","observation_id":"c63adc82-6224-4d5b-9678-88897cd54dfe","resolution":{"observed_at":"2026-08-06T23:49:49.444103Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.04006","last_updated":"2020-11-08T15:53:56Z","snapshot_observed_at":"2026-07-06T10:12:38.348940Z","submitted_at":"2020-11-08T15:53:56Z","title":"Long Range Arena: A Benchmark for Efficient Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.04006","snapshot_observed_at":"2026-08-06T23:49:47.407269Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.407269Z"},"links":{"cited_paper":"/paper/2011.04006","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:020ea543bef39a0b9b10da20add87fc32043aae2e17f738e274ba925e267df00","observation_id":"6272fee1-3493-4ae4-a8b7-0fe84e220959","resolution":{"observed_at":"2026-08-06T23:49:47.407269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.092742Z","title":null,"venue":null,"work_id":"38fc0fe2-4604-4d23-a498-a2f9c2b889a8","year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.467394Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:9e0b3caa28a0ba0d90496ded6b4a87f2597cd743b64906c6d53e3b1cc002f620","observation_id":"b233dbd9-8c9d-474e-a345-722c41b0d59b","resolution":{"observed_at":"2026-08-06T23:49:51.205623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.916856Z","title":null,"venue":null,"work_id":"936b9645-cb3f-4e15-8b71-17b40c15aaf0","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.581044Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:774dfebadc925380e750c55e8cf528a1f77d9835084e0fa00d110664d58c0887","observation_id":"0883774c-4db3-4d91-a393-76b9d3224910","resolution":{"observed_at":"2026-08-06T23:49:51.006117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:49:47.732683Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.732683Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:7812df6bbfd5f4a40a61b8157c8ea9fe75acbe72be9ce0fb57a5432801a9463a","observation_id":"16eff6a0-1561-4ddd-9491-e91ea99aa61c","resolution":{"observed_at":"2026-08-06T23:49:47.732683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-06T10:06:21.140448Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-06T23:49:47.837626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.837626Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:a41116bf76609529697642cd19b322aae1396b53eed8ab3ee09d6bd7aff0bb43","observation_id":"164df63e-321b-459d-a263-6131ebd555aa","resolution":{"observed_at":"2026-08-06T23:49:47.837626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-06T23:49:47.916012Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.916012Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:644bbef1b08884ecc94ec97b18817fa7861d5d528e9b49d4b2fd2a098dae4d1f","observation_id":"95be38fa-aece-4e88-8109-e4c96cdb5f47","resolution":{"observed_at":"2026-08-06T23:49:47.916012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13766","last_updated":"2025-03-11T17:31:27Z","snapshot_observed_at":"2026-08-03T10:33:33.362949Z","submitted_at":"2024-07-18T17:59:30Z","title":"Visual Haystacks: A Vision-Centric Needle-In-A-Haystack Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13766","snapshot_observed_at":"2026-08-06T23:49:48.044179Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.044179Z"},"links":{"cited_paper":"/paper/2407.13766","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:9aa627474465311434543747ca54a8cbdb7675603711af58e6d192129ab66ca4","observation_id":"1d64bf2a-1c1b-4886-bc56-f5b34b402675","resolution":{"observed_at":"2026-08-06T23:49:48.044179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16039","last_updated":"2023-11-14T01:40:13Z","snapshot_observed_at":"2026-07-06T16:24:38.375055Z","submitted_at":"2023-09-27T21:41:49Z","title":"Effective Long-Context Scaling of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16039","snapshot_observed_at":"2026-08-06T23:49:48.167491Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.167491Z"},"links":{"cited_paper":"/paper/2309.16039","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:a1b456f6d2a43ef7c49f8d3b089399963b3d87ba6fc510eb1d8be451091aad55","observation_id":"1af95218-cebe-4276-b85b-922499cfaf73","resolution":{"observed_at":"2026-08-06T23:49:48.167491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.684860Z","title":null,"venue":null,"work_id":"0dad43e1-87ee-48ce-8641-f4bd2cbd0250","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.262762Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:1603e60192621f5e4eaf62b4dcbfe2833ccfe48f2112759b0c5c436b36ae1bad","observation_id":"94a2298e-0f4d-4ee8-ac87-a8499243abc1","resolution":{"observed_at":"2026-08-06T23:49:50.776994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.498704Z","title":null,"venue":null,"work_id":"b622a6a7-de9d-498a-bd3a-a33e9cb17d4a","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.378006Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:bfa7732fe0737aa366ac08d76d075cd35f313c482ea13967b3ad3b44a454da79","observation_id":"43cd9b3f-4865-4c7d-8ad1-16fd701443bd","resolution":{"observed_at":"2026-08-06T23:49:50.613756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.317135Z","title":null,"venue":null,"work_id":"1f88ec0d-0033-4ea8-b5ae-5b3140cab65f","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.477481Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:db6dff230d6aeff41b251ee6d90cdee77e4a1803c920df18a6b4fbc4720913de","observation_id":"a6f978f5-fece-457e-b9b1-eb2383e21ca4","resolution":{"observed_at":"2026-08-06T23:49:50.390405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.139320Z","title":null,"venue":null,"work_id":"ea437717-9c8c-4420-ab7a-e0aa56abba32","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.564204Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:426d3fa6d7ff6da82522a5face084d88168d3c8b31af69f40b4cc4bceee60403","observation_id":"835d83dc-d79c-49c9-9398-323753002d8e","resolution":{"observed_at":"2026-08-06T23:49:50.209143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-04T23:38:14.844517Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-06T23:49:48.654069Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.654069Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:7d153d79c8cec4872cbe5fb364ff314f5f629b2e71e6ed4aef49c8c3ad6e09b9","observation_id":"a45831ae-3018-49f0-b5f9-0c5dc3b00652","resolution":{"observed_at":"2026-08-06T23:49:48.654069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:48.826479Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.826479Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:f631df1c6f4c35a72ab40c9b812ebe1f5acaf65b3a4f1c7eb425c4b39a2dab5f","observation_id":"5c289b82-76f9-485d-9729-a6e8826b1212","resolution":{"observed_at":"2026-08-06T23:49:48.826479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21252","last_updated":"2024-10-28T17:50:42Z","snapshot_observed_at":"2026-07-06T19:40:57.049203Z","submitted_at":"2024-10-28T17:50:42Z","title":"LongReward: Improving Long-context Large Language Models with AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21252","snapshot_observed_at":"2026-08-06T23:49:48.916548Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.916548Z"},"links":{"cited_paper":"/paper/2410.21252","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:20e850b137182e6afc72fd83ee7f8bb0af843268c486bcd5adcb9c3b52521f76","observation_id":"3fe594dc-d118-4ddf-9c68-3c4e21e6461c","resolution":{"observed_at":"2026-08-06T23:49:48.916548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:49.024302Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:49.024302Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:0fa65f6cd4c24f4816e4e406ffcd0588403db7dac01c27671d52dceff73d0f1b","observation_id":"3e0be4d5-c228-4e61-a556-972f360edc0e","resolution":{"observed_at":"2026-08-06T23:49:49.024302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:49.180444Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:49.180444Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:6e7f83c82ac850c69fcc33c2132c25510939384d6ed22531c3de59ba363020c7","observation_id":"3fd049d2-2af4-4dbb-8589-4f3b74950240","resolution":{"observed_at":"2026-08-06T23:49:49.180444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 3 inbound Pith citation observations for arXiv:2506.16024."}