{"as_of":"2026-08-21T20:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2bff04870f9b41a05673099f1b564f5664cf05fe1f5196096618d2190825ad95","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:08:12.087697Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:36:05.751022Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T02:29:25.233098Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":"2506.13356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356","venue":null,"work_id":"67ca9ba7-8df2-4782-b66f-0f84112ba0c4","year":2025},"citing_paper":{"arxiv_id":"2507.05257","last_updated":"2026-06-28T17:25:01Z","snapshot_observed_at":"2026-08-14T05:17:05.174902Z","submitted_at":"2025-07-07T17:59:54Z","title":"Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T21:20:22.146417Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2507.05257"},"observation_digest":"sha256:e2da39ea0a92dc2a14c2ffe474203ffba3667136bcb681d36af7b3344f000df2","observation_id":"fc514041-df33-48a7-8dc8-e135856eddf9","resolution":{"observed_at":"2026-05-16T21:20:22.260588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-08-06T19:36:05.751022Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05257","last_updated":"2026-06-28T17:25:01Z","snapshot_observed_at":"2026-08-14T05:17:05.174902Z","submitted_at":"2025-07-07T17:59:54Z","title":"Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:36:05.751022Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2507.05257"},"observation_digest":"sha256:ffa53275df2d29be3efb0d81113af445416379348d17c1f3aa1dd766dc3ca87d","observation_id":"99af9aae-2f5e-47a5-a31e-b252d9768f55","resolution":{"observed_at":"2026-08-06T19:36:05.751022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":"2506.13356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356","venue":null,"work_id":"67ca9ba7-8df2-4782-b66f-0f84112ba0c4","year":2025},"citing_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-14T22:23:14.621091Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2507.21046"},"observation_digest":"sha256:8111eca5b67943cf625749b41510719dc5c7362d112c15708fc1f539f713c3ac","observation_id":"f28ed759-8378-4802-89c6-4dda3ee488f0","resolution":{"observed_at":"2026-05-14T22:23:15.770267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":"2506.13356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356","venue":null,"work_id":"67ca9ba7-8df2-4782-b66f-0f84112ba0c4","year":2025},"citing_paper":{"arxiv_id":"2511.20857","last_updated":"2026-05-18T16:18:02Z","snapshot_observed_at":"2026-08-20T12:55:17.970132Z","submitted_at":"2025-11-25T21:08:07Z","title":"Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-14T23:13:15.016486Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2511.20857"},"observation_digest":"sha256:dc5cf2a7506b858a82ddfcc37c5f7c8417d8aa6074f78587621a66338fe74dad","observation_id":"9f37cf52-1f65-4a4c-b070-763b30f745ef","resolution":{"observed_at":"2026-05-14T23:13:16.118967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-08-03T11:01:43.577854Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07978","last_updated":"2026-07-13T12:55:23Z","snapshot_observed_at":"2026-08-03T11:01:42.993651Z","submitted_at":"2026-01-12T20:20:35Z","title":"Cost and Accuracy of Long-Term Memory in Distributed Multi-Agent Systems Based on Large Language Models","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T11:01:43.577854Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2601.07978"},"observation_digest":"sha256:6ab342711b24fcb7230f7565160f19ab5502f45b84e0ce38ee7b64374715d5e1","observation_id":"b1c0d3c9-3af2-4d47-92cc-23664cac1401","resolution":{"observed_at":"2026-08-03T11:01:43.577854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-08-03T09:21:42.468772Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14192","last_updated":"2026-07-03T11:26:58Z","snapshot_observed_at":"2026-08-20T13:01:24.661226Z","submitted_at":"2026-01-20T17:51:56Z","title":"Toward Efficient Agents: Memory, Tool learning, and Planning","version":2},"reference_index":122,"source":"pdf_text","source_observed_at":"2026-08-03T09:21:42.468772Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2601.14192"},"observation_digest":"sha256:b987a2b686a7d81a929260905ef041f46da00026294c3be479d2f580920ee677","observation_id":"7448e09e-0062-44f7-86b9-ba38d68b59c2","resolution":{"observed_at":"2026-08-03T09:21:42.468772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":"2506.13356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356","venue":null,"work_id":"67ca9ba7-8df2-4782-b66f-0f84112ba0c4","year":2025},"citing_paper":{"arxiv_id":"2605.06716","last_updated":"2026-05-07T03:38:48Z","snapshot_observed_at":"2026-08-12T17:59:39.734132Z","submitted_at":"2026-05-07T03:38:48Z","title":"From Storage to Experience: A Survey on the Evolution of LLM Agent Memory Mechanisms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T01:10:12.281373Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2605.06716"},"observation_digest":"sha256:65e0502b0686a19bf9f566d0f3512d0f467eebdd373704174b9a42a974b0fc9b","observation_id":"eb03873c-da9d-4f31-93b8-ae173f8e4696","resolution":{"observed_at":"2026-05-11T04:40:58.950764Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":"2506.13356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356","venue":null,"work_id":"67ca9ba7-8df2-4782-b66f-0f84112ba0c4","year":2025},"citing_paper":{"arxiv_id":"2605.09874","last_updated":"2026-08-18T20:07:49Z","snapshot_observed_at":"2026-08-21T20:12:05.924611Z","submitted_at":"2026-05-11T01:59:59Z","title":"EgoMemReason: A Memory-Driven Reasoning Benchmark for Long-Horizon Egocentric Video Understanding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-12T04:37:46.090777Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2605.09874"},"observation_digest":"sha256:22b5448a6140d7c3aac1ce9d1c51f3060b97ace74741c1de3080f0b55c500518","observation_id":"532bf676-1e9a-4949-b3dd-e4ac8cf8a4b3","resolution":{"observed_at":"2026-05-12T06:06:24.465188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"cited_work":{"arxiv_id":"2506.13356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13356","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Storybench: A dynamic benchmark for evaluating long-term memory with multi turns.arXiv preprint arXiv:2506.13356","venue":null,"work_id":"67ca9ba7-8df2-4782-b66f-0f84112ba0c4","year":2025},"citing_paper":{"arxiv_id":"2605.20926","last_updated":"2026-05-20T09:11:04Z","snapshot_observed_at":"2026-08-15T15:14:04.098061Z","submitted_at":"2026-05-20T09:11:04Z","title":"MemConflict: Evaluating Long-Term Memory Systems Under Memory Conflicts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T02:27:03.246763Z"},"links":{"cited_paper":"/paper/2506.13356","citing_paper":"/paper/2605.20926"},"observation_digest":"sha256:59ad63f3bad134e1552548469b5c3589f935d8ca45285c9b973d4d2069fde99e","observation_id":"daa066a6-8d23-49d6-95ea-e2a59ac9b31d","resolution":{"observed_at":"2026-05-21T02:29:25.236761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13356/citation-record","integrity":"/paper/2506.13356/integrity","json":"/paper/2506.13356/citation-record.json","paper":"/paper/2506.13356"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.764211Z","title":"L-eval: Instituting standardized evaluation for long context language models","venue":null,"work_id":"98e6bc20-fd64-4c66-82d5-f02812fc4df8","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.915064Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:d17a49a34f8af9964a178768eddd2575515b81372d67e2b0b4ca96808f05f3c3","observation_id":"69f57222-94a4-4327-b27b-0aed18bfc6a9","resolution":{"observed_at":"2026-08-15T20:08:12.769044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.752641Z","title":"Claude 3.5 sonnet model card addendum, 2024","venue":null,"work_id":"1de90bda-c1c9-4aef-81c9-0a3c551be4d1","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.920323Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:b8cfe2d088792ccde7d3941ed845f105a9b702ef158f766bc0e1b985eb8dcfde","observation_id":"7ed84ab1-713b-4448-b30b-14f2e79ef3aa","resolution":{"observed_at":"2026-08-15T20:08:12.756334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.739943Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":"e226740c-36e2-474f-a91c-204e0ee12b83","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.923913Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:419cbae5cc5c3d3ce79ae39684f2da3454410cba5b968c94e156651b27aded2a","observation_id":"1abb18d2-cf36-4687-989d-71b09d92895e","resolution":{"observed_at":"2026-08-15T20:08:12.744342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s13218-023-00809-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-20T11:03:42.707129Z","title":"Opportunities and challenges for ai-based analysis of rwd in pharmaceutical r&d: A practical perspective","venue":"K&uuml;nstliche Intell.","work_id":"dfbeed89-3df1-48e0-9d61-572642824116","year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.928097Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:9a921e17dfa71ad3167d6c2f01c9f19e48fe19d910fc189402493674ac65f9cb","observation_id":"e4301444-94b0-4798-8966-9f82e87aea12","resolution":{"observed_at":"2026-08-15T20:08:12.255655Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-15T20:08:11.932113Z","title":"Longformer: The long-document transformer","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.932113Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:0848ea01e4007ee0777d61d521f95911c07128f5093ade3efe9a84674f231752","observation_id":"52f1139f-f545-4249-be2d-6553fd5ce5d3","resolution":{"observed_at":"2026-08-15T20:08:11.932113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.728766Z","title":"Doubao-1.5-pro, 2025","venue":null,"work_id":"e5efe9b5-cffa-404b-bf47-0c807457f724","year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.935671Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:15098bc413d70862afdb9a179c6ee3d5844988fef229c3c9bcaeca4c9f6bd6f8","observation_id":"64c3555e-fdfc-4410-b5b2-7320115c2b16","resolution":{"observed_at":"2026-08-15T20:08:12.732354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.716975Z","title":"Beyond prompts: Dynamic conversational benchmarking of large language models","venue":null,"work_id":"d2c69783-47f6-41bc-a513-9c595502efd7","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.939133Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:798efe2849653604d9d2f349b590f4b57bb11bfbd5bf7668beff08834bc39d0f","observation_id":"76bb980a-89b2-4566-ace6-fe53e7a76961","resolution":{"observed_at":"2026-08-15T20:08:12.720802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:11.942410Z","title":"A survey on evaluation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.942410Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:9e8058bd9f8d60e55b03787fca7bc854caaca02a54fe84327150a8c72eb0cd51","observation_id":"75025580-5c20-40bd-a85a-598cf664da1f","resolution":{"observed_at":"2026-08-15T20:08:11.942410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10165","last_updated":"2025-02-24T08:42:25Z","snapshot_observed_at":"2026-08-18T13:01:58.711060Z","submitted_at":"2024-10-14T05:18:02Z","title":"HSR-Enhanced Sparse Attention Acceleration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10165","snapshot_observed_at":"2026-08-15T20:08:11.945104Z","title":"Hsr-enhanced sparse attention acceleration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.945104Z"},"links":{"cited_paper":"/paper/2410.10165","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:09fa9db75be47c5f8c81e5126ed9321cbf507283c080d570216623020581bee4","observation_id":"30825cda-7ffa-477b-9936-6531273d6041","resolution":{"observed_at":"2026-08-15T20:08:11.945104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.698178Z","title":"Llf-bench: Benchmark for interactive learning from language feedback","venue":null,"work_id":"ff1e9a16-5f13-461b-9639-7cd29ab8a1c5","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.948517Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:a45ecce89f5a0807f6492d75e090d293d3eac7c15a4a4f13f6f56e190a25f46b","observation_id":"c8f64c8d-fabf-4ddc-8e22-cc4ad1adbe3c","resolution":{"observed_at":"2026-08-15T20:08:12.702509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-14T23:23:31.683130Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-15T20:08:11.951699Z","title":"Mem0: Building production-ready ai agents with scalable long-term memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.951699Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:122ff36c1b10792604bcff7d3a380059d3ba39782495481068eb52cf5be1caac","observation_id":"1d8dc7ee-df25-400d-871d-6d960ceaa94b","resolution":{"observed_at":"2026-08-15T20:08:11.951699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.688076Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":"55303821-be38-4f69-bf7e-c90fb47cf03e","year":1904},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.955423Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:44ad917a6e548ed6f46a8cf692e07d8f7e97075502181855803bada284e50592","observation_id":"b7030dd1-ff99-4c8f-8cc3-f9f7b72fb9a3","resolution":{"observed_at":"2026-08-15T20:08:12.691205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02860","last_updated":"2019-06-02T21:21:48Z","snapshot_observed_at":"2026-08-16T17:45:52.864524Z","submitted_at":"2019-01-09T18:28:19Z","title":"Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.02860","snapshot_observed_at":"2026-08-15T20:08:11.958869Z","title":"Transformer-xl: Attentive language models beyond a fixed-length context","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.958869Z"},"links":{"cited_paper":"/paper/1901.02860","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:d09a99b4eb9d7066befa4185744c4387184a1c8ab6b77f5ccb8d49d4b9588f9c","observation_id":"fbb4c577-d707-491e-9575-d4ee2ddda1cb","resolution":{"observed_at":"2026-08-15T20:08:11.958869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.675786Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":"0ce5b5c4-d2f0-483b-9e65-66cc0f978626","year":2022},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.962474Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:aedb7a345d1d3e7325e4d372a463bdf0a8eca102f2f348e53f9c216a55a126b8","observation_id":"20c3f5dd-f178-4685-9bb3-9d23f8578e9d","resolution":{"observed_at":"2026-08-15T20:08:12.680009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:08:11.965879Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.965879Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:1fe42c5e3bf28801e4dbc24d4d64989ec272fc437484ca4473dd8db7340a9415","observation_id":"b2c98317-7572-46b2-aef7-3745b43a8fa7","resolution":{"observed_at":"2026-08-15T20:08:11.965879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.663605Z","title":"Cervical cancer segmentation based on full-scale feature fusion with cascading-attention and dilated convolution","venue":null,"work_id":"4329769e-66d6-47b1-b5cc-2a5e63128c9b","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.969800Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:4bced5883e136c49c710b47bcffbfa51055445210aa9608514b03686a5d36a2a","observation_id":"9f1e6352-ea59-40ed-9f65-c7d6e524c7f0","resolution":{"observed_at":"2026-08-15T20:08:12.667483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.651223Z","title":"BAMBOO : A comprehensive benchmark for evaluating long text modeling capacities of large language models","venue":null,"work_id":"758ba85f-7143-4213-b833-6f36f1129bdd","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.973152Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:6feaa86e6e200687bd0e1b2795e1725b4bff296c06139ed58228fcdbeab6bd8e","observation_id":"038ec467-1243-4d5d-a0f7-844cf694a475","resolution":{"observed_at":"2026-08-15T20:08:12.655732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.640660Z","title":"Knowledge retention: 8 main strategies to improve it, February 2024","venue":null,"work_id":"aba0cdb6-c9d5-46c5-b238-fcdec3eaf165","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.976644Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:6076f2ecf560023456ea56d632996e019d8be1e659824b4fd63872793ddfaa26","observation_id":"33be54da-4aa4-4852-a1f0-5f1157324d84","resolution":{"observed_at":"2026-08-15T20:08:12.644375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:11.979699Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.979699Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:c8fd30492f36da59b91f212a8a3d6675e739fd569389a16d35db47cbb2776888","observation_id":"622a8289-afee-4a07-a1d1-4f732e5a7fdf","resolution":{"observed_at":"2026-08-15T20:08:11.979699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2505.23596","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.227583Z","title":"MAPLE: A Mobile Agent with Persistent Finite State Machines for Structured Task Reasoning","venue":null,"work_id":"9b63849d-55e0-4e92-a94a-ad9d9ae21b93","year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.982835Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:bb52a686f0bba984dc7cdc9134cf2e27b1b8c3cb1e0f103eb554a3c3c464fd78","observation_id":"0549d748-8eb2-48c3-8c70-8efd52c650c9","resolution":{"observed_at":"2026-08-15T20:08:12.233969Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.622718Z","title":"Hipporag: Neurobiologically inspired long-term memory for large language models","venue":null,"work_id":"dc4c7a3c-73a6-4687-80c5-85f2c0dd13a7","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.985766Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:a916f0fa58462b166c8280cb3ea8fcb4fca869963520799e7e7e6c6c888489c8","observation_id":"f645c181-9bad-4323-9966-509ca3f0f567","resolution":{"observed_at":"2026-08-15T20:08:12.626692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.611662Z","title":"Layer-adaptive low-rank adaptation of large asr model for low-resource multilingual scenarios","venue":null,"work_id":"06228562-e848-46b3-a3ef-006193c9c18a","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.990084Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:abfa95c0220a5d9c870b6469e62008bd579fa753752100b9f23e69041b165ad5","observation_id":"4811842e-b86c-4b43-ab18-0619868e0c43","resolution":{"observed_at":"2026-08-15T20:08:12.615869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01629","last_updated":"2024-01-03T09:03:30Z","snapshot_observed_at":"2026-08-16T14:30:09.132560Z","submitted_at":"2024-01-03T09:03:30Z","title":"Synthetic Data in AI: Challenges, Applications, and Ethical Implications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01629","snapshot_observed_at":"2026-08-15T20:08:11.993263Z","title":"Synthetic Data in AI: Challenges, Applications, and Ethical Implications","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.993263Z"},"links":{"cited_paper":"/paper/2401.01629","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:7e3c4e72c70f04beebfd3901167d457978dc59c3817426f619f62f146bfebd5e","observation_id":"517d0326-d456-4670-902e-84f9fccaddff","resolution":{"observed_at":"2026-08-15T20:08:11.993263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.600981Z","title":"Ruler: What's the real context size of your long-context language models? CoRR, 2024","venue":null,"work_id":"754e3e5b-5658-4cd8-aca8-254d95b001a7","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:11.996846Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:bc63cb669daa7cf3190447e31f6b87ccb357aac9d96dfe060a8fbe80940a14e4","observation_id":"5b6804b3-1f29-4533-9e90-c7150b8a4141","resolution":{"observed_at":"2026-08-15T20:08:12.604910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.000185Z","title":"Needle in a haystack - pressure testing llms, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.000185Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:0f07ba2a62861172b28847980d52f97cdd2a738d5539b0c1efce8d99403ca26c","observation_id":"53b4a1ad-deb7-4bdb-9acd-c98d0990871b","resolution":{"observed_at":"2026-08-15T20:08:12.000185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.003410Z","title":"Reformer: The efficient transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.003410Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:e0fc348a2a81f5082b8abb4d686ebe55ed6c67a6a95b7cfa2edfbfefc440ae6e","observation_id":"12c40333-58d1-4706-a49c-a65dd8ae1b6e","resolution":{"observed_at":"2026-08-15T20:08:12.003410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.576113Z","title":"Babilong: Testing the limits of llms with long context reasoning-in-a-haystack","venue":null,"work_id":"ef110d86-fa52-4986-9ee7-29467564f953","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.006634Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:7cef4282a296bdc8b725266d88d9e9d1b4d57b87d12bbdda63c7e4ae8999a443","observation_id":"3f79d0d3-3e9a-48ed-b760-31b958a054c8","resolution":{"observed_at":"2026-08-15T20:08:12.580116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.010674Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.010674Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:5c3c59b032e672875fbf6f510bb38f41e8eb1e6d134e31bbb5e8858ba4062a1b","observation_id":"6d22d922-771d-4387-a45c-df86270cba5c","resolution":{"observed_at":"2026-08-15T20:08:12.010674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09727","last_updated":"2024-07-22T05:33:51Z","snapshot_observed_at":"2026-08-16T14:18:25.465305Z","submitted_at":"2024-02-15T05:40:21Z","title":"A Human-Inspired Reading Agent with Gist Memory of Very Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09727","snapshot_observed_at":"2026-08-15T20:08:12.013881Z","title":"A Human-Inspired Reading Agent with Gist Memory of Very Long Contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.013881Z"},"links":{"cited_paper":"/paper/2402.09727","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:6c8eb0f5a0326dbfef3038739cb1cc3f64fd7c1190a26735e597ed194160c032","observation_id":"880da2a9-324a-4cd8-9e0a-d6ce8c8139e8","resolution":{"observed_at":"2026-08-15T20:08:12.013881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.557854Z","title":"Loogle: Can long-context language models understand long contexts? arXiv e-prints, pages arXiv--2311, 2023","venue":null,"work_id":"b9c9fbf9-cf29-4bc2-845c-7c84d261fb24","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.017573Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:085a3123280ce56e467cdd86fb4375e5efa0ce38cad3df7866172ea729a376c8","observation_id":"a33f96fb-ac34-4107-8291-a5f15609a4fb","resolution":{"observed_at":"2026-08-15T20:08:12.561384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.548822Z","title":"Ringattention with blockwise transformers for near-infinite context","venue":null,"work_id":"d2ed9618-5afe-442d-b51c-66ab762340d4","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.021339Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:dcf7a243966bb95bd0ce503c61643e57e185a43c08b0f556188b814b5c55f843","observation_id":"3867c032-6a6e-4bd8-82b1-7d5e96f31564","resolution":{"observed_at":"2026-08-15T20:08:12.551788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07503","last_updated":"2024-08-10T20:46:47Z","snapshot_observed_at":"2026-08-21T18:36:24.315368Z","submitted_at":"2024-04-11T06:34:17Z","title":"Best Practices and Lessons Learned on Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07503","snapshot_observed_at":"2026-08-15T20:08:12.025044Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.025044Z"},"links":{"cited_paper":"/paper/2404.07503","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:ea1631864af626e1030410735d49dbcc85f7dd8c711151642dd367c8f02a0248","observation_id":"942a7a22-6870-4fd7-8cb8-6a825ee71d37","resolution":{"observed_at":"2026-08-15T20:08:12.025044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.538067Z","title":"Agentbench: Evaluating llms as agents","venue":null,"work_id":"b7a721a6-2362-4f97-a7ae-31f4ea87508a","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.029113Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:0322f45d53af476a91c3fb7f920ae65f6de0dbe795d4e98d16a1e7029cb402dc","observation_id":"fa3a05e5-cda4-461e-9e73-4deb49414c07","resolution":{"observed_at":"2026-08-15T20:08:12.541685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.033418Z","title":"Hello gpt-4o, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.033418Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:f5026153974ae7ace060f3120c37014db188f25afbe2fb82c1f10add07d2acb4","observation_id":"e87b24f4-fa0f-449a-aec4-298bc9af453a","resolution":{"observed_at":"2026-08-15T20:08:12.033418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.521109Z","title":"Memgpt: Towards llms as operating systems","venue":null,"work_id":"ffdb5e2f-ff6c-4b2c-8989-9564b34bf8db","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.037587Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:6f23dacdd2e0afa1daffad13828eac7edc45a7dcf389188ae924664fc3f31e00","observation_id":"df2a3246-c07b-4e3d-925f-43b818c3d8ab","resolution":{"observed_at":"2026-08-15T20:08:12.524801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.510543Z","title":"Faster causal attention over large sequences through sparse flash attention","venue":null,"work_id":"27270ae8-578a-4af9-81bb-c1f2b6482ecb","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.042114Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:1802e4493b2241195d5aba774232aaab132352d009433f4af780b0774a2d3e11","observation_id":"08278005-64cb-42c2-88bc-c5ecf46618e7","resolution":{"observed_at":"2026-08-15T20:08:12.514056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.500758Z","title":"Rwkv: Reinventing rnns for the transformer era","venue":null,"work_id":"b128d1fe-6173-49e4-a9c9-27c3b40b6662","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.045250Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:48a85f5ff421925276d7eaea547dfbfb85c0b08d6df9a7dab3a6087073e710c8","observation_id":"ce6c93a0-232e-4884-a3ae-0ee440bd6132","resolution":{"observed_at":"2026-08-15T20:08:12.503812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.392618Z","title":"Do transformers need deep long-range memory? In Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics, pages 7524--7529","venue":null,"work_id":"e5c73a2c-4836-4f6c-98b5-de3f89bf516e","year":2020},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.048708Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:1e01c4a44867ada02f6ed9d346b6f28adf11166e0351505f6f5fd94cef0a55a9","observation_id":"3f795acf-3c7c-48f9-a558-e40fa83addef","resolution":{"observed_at":"2026-08-15T20:08:12.396431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.381529Z","title":"Zeroscrolls: A zero-shot benchmark for long text understanding","venue":null,"work_id":"af360383-295c-4c3f-88f0-8e360d15b20e","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.052059Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:a7da1be940e39116e748fcbb598caf59317b568d18dce98d093eee3a353891d5","observation_id":"ce696ee4-53fe-4da3-82a4-6c0ad90444a4","resolution":{"observed_at":"2026-08-15T20:08:12.385792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02441","last_updated":"2025-04-24T01:47:25Z","snapshot_observed_at":"2026-08-16T12:44:19.643355Z","submitted_at":"2025-04-03T09:58:19Z","title":"Cognitive Memory in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02441","snapshot_observed_at":"2026-08-15T20:08:12.055184Z","title":"Cognitive Memory in Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.055184Z"},"links":{"cited_paper":"/paper/2504.02441","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:4827b1374411f9aa15979a25e34b1f65f372a2f340e169738b3cb5ae6f2e2fdc","observation_id":"3f7e7546-8de6-4ca4-8df8-851fdb57839f","resolution":{"observed_at":"2026-08-15T20:08:12.055184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.371407Z","title":"Chapterbreak: A challenge dataset for long-range language models","venue":null,"work_id":"2de796d8-9509-4c00-a5ab-fca0284ee55a","year":2022},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.058341Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:a83f6b6efc2a48dbeff3ee7a87682c45b677facb56db31de1b71e8d1e1fe4cf5","observation_id":"ba3fd16b-0a37-4b3e-a28b-d8457f571f12","resolution":{"observed_at":"2026-08-15T20:08:12.374814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15965","last_updated":"2025-04-23T13:47:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T15:05:04Z","title":"From Human Memory to AI Memory: A Survey on Memory Mechanisms in the Era of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15965","snapshot_observed_at":"2026-08-15T20:08:12.062760Z","title":"From Human Memory to AI Memory: A Survey on Memory Mechanisms in the Era of LLMs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.062760Z"},"links":{"cited_paper":"/paper/2504.15965","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:8dd7fceb54cf3ae8ed938b7e1a6cba31a2a6af91edb55af51e8d735e113bcf74","observation_id":"1235262d-f1f6-4c76-a6ec-553d096a8e14","resolution":{"observed_at":"2026-08-15T20:08:12.062760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07487","last_updated":"2025-01-13T17:04:23Z","snapshot_observed_at":"2026-08-12T19:26:27.816837Z","submitted_at":"2025-01-13T17:04:23Z","title":"Data and System Perspectives of Sustainable Artificial Intelligence","version":1},"cited_work":{"arxiv_id":"2501.07487","doi":"10.48550/arxiv.2501.07487","metadata_source":"pith","pith_arxiv_id":"2501.07487","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"Data and System Perspectives of Sustainable Artificial Intelligence","venue":"cs.AI","work_id":"73ed329e-b31f-48da-933e-46ac4c93fd59","year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.066826Z"},"links":{"cited_paper":"/paper/2501.07487","citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:03e52f6ca37cef85663845097e7add6618e77028952558fec0ba2733464e46f0","observation_id":"e8988212-e8e1-433f-80ae-323fbf6efeb9","resolution":{"observed_at":"2026-08-15T20:08:12.123172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.360227Z","title":"Long time no see! open-domain conversation with long-term persona memory","venue":null,"work_id":"2960440a-ce35-4ebb-a7f3-6c6b30140a89","year":2022},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.071189Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:79ebd3effae6ac6cdc12848890cc25500a23dfcfe063b64852fcbf423620b61d","observation_id":"198e470d-761b-4afa-b4b1-1a2c2b384e8e","resolution":{"observed_at":"2026-08-15T20:08:12.364239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.348706Z","title":"Memoryscope, 09 2024","venue":null,"work_id":"711954d1-e1a5-4d15-8b3f-28fcbd205c78","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.074534Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:9dcf4908976d469449eabe33091ab2412ad5c8f4b6ed07e1b751966d7b2ecd27","observation_id":"8a92f438-4eb9-4409-9cf8-14a5e02d4c28","resolution":{"observed_at":"2026-08-15T20:08:12.352260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.337845Z","title":"A survey on multi-turn interaction capabilities of large language models","venue":null,"work_id":"458d711e-b81d-4b81-b261-a010cd0aff60","year":2025},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.077663Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:5525c308dc794cf58bed110f4933eb25592f36988a5fcabf65ea50ccd8cb6152","observation_id":"8e3d5258-fa73-4fea-a4b5-b8d4143315d5","resolution":{"observed_at":"2026-08-15T20:08:12.342056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.326033Z","title":"bench: Extending long context evaluation beyond 100k tokens","venue":null,"work_id":"32f25a81-65ad-4dc3-9800-49bf83a91727","year":2024},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.080639Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:529bab73f5c9f0c0256c6e1455e5a03775c987c21c4834ab71cb3fdd37766555","observation_id":"efe79906-4df8-4582-8fc7-89ca9fefdd50","resolution":{"observed_at":"2026-08-15T20:08:12.329481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.315659Z","title":"Memorybank: Enhancing large language models with long-term memory","venue":null,"work_id":"5139941c-05f3-4c30-bd2f-338de317a0f0","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.083371Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:70df1d2abd4120b3b96afb2065a2f2104fc89bb132d9ac7d1a8d63acd3fce9b9","observation_id":"7b4c4dbd-2ba5-4df7-81b8-e95e555afd8c","resolution":{"observed_at":"2026-08-15T20:08:12.319299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:08:12.303541Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":"9387f5af-de58-4281-8b06-20ea9a286d43","year":2023},"citing_paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:12.087697Z"},"links":{"citing_paper":"/paper/2506.13356"},"observation_digest":"sha256:37771335a00fb1a7f52c9b5af9c88aa6bb8d160282d7ca8c1b53ef9d9bd13f9a","observation_id":"e16ef2a4-d38e-4a14-a8d8-322a289bf299","resolution":{"observed_at":"2026-08-15T20:08:12.308084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.13356","last_updated":"2025-06-16T10:54:31Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T18:36:46.051091Z","submitted_at":"2025-06-16T10:54:31Z","title":"StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":3,"verified_fuzzy":30},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 9 inbound Pith citation observations for arXiv:2506.13356."}