{"as_of":"2026-08-07T23:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:540e3afa59f36f22dd577386c7a990f589bf490d65385eb0ea39153094f49ce5","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T23:32:09.911061Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:58:31.994649Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T03:57:38.260075Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"cited_work":{"arxiv_id":"2602.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.13626","snapshot_observed_at":"2026-07-03T03:57:38.260075Z","title":"Benchmark leakage trap: Can we trust llm-based recommendation?arXiv preprint arXiv:2602.13626","venue":"cs.LG","work_id":"9318438e-cd7a-40f5-9c46-97e5b0eba080","year":2026},"citing_paper":{"arxiv_id":"2605.08838","last_updated":"2026-05-09T09:48:50Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T09:48:50Z","title":"Generating Leakage-Free Benchmarks for Robust RAG Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T03:04:39.253429Z"},"links":{"cited_paper":"/paper/2602.13626","citing_paper":"/paper/2605.08838"},"observation_digest":"sha256:4df0bf4b42474935950ff4f5b89f09b071ba9e59f0a3da66354cae63c6259516","observation_id":"9c1db78e-ec38-47d9-8704-72d6300f7308","resolution":{"observed_at":"2026-05-27T02:05:11.978910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"cited_work":{"arxiv_id":"2602.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.13626","snapshot_observed_at":"2026-07-03T03:57:38.260075Z","title":"Benchmark leakage trap: Can we trust llm-based recommendation?arXiv preprint arXiv:2602.13626","venue":"cs.LG","work_id":"9318438e-cd7a-40f5-9c46-97e5b0eba080","year":2026},"citing_paper":{"arxiv_id":"2606.10156","last_updated":"2026-07-24T21:13:14Z","snapshot_observed_at":"2026-08-06T23:56:02.901369Z","submitted_at":"2026-06-08T20:35:45Z","title":"$\\tau$-Rec: A Verifiable Benchmark for Agentic Recommender Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T14:25:46.669942Z"},"links":{"cited_paper":"/paper/2602.13626","citing_paper":"/paper/2606.10156"},"observation_digest":"sha256:42eb2705e97e2805f0e057859c1dafed5d33902ebb9064e55d0becb51fefbde6","observation_id":"0770b013-f1ed-4824-814d-15a6d5ff5256","resolution":{"observed_at":"2026-07-03T03:57:38.261268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"cited_work":{"arxiv_id":"2602.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.13626","snapshot_observed_at":"2026-07-03T03:57:38.260075Z","title":"Benchmark leakage trap: Can we trust llm-based recommendation?arXiv preprint arXiv:2602.13626","venue":"cs.LG","work_id":"9318438e-cd7a-40f5-9c46-97e5b0eba080","year":2026},"citing_paper":{"arxiv_id":"2606.10156","last_updated":"2026-07-24T21:13:14Z","snapshot_observed_at":"2026-08-06T23:56:02.901369Z","submitted_at":"2026-06-08T20:35:45Z","title":"$\\tau$-Rec: A Verifiable Benchmark for Agentic Recommender Systems","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T02:24:02.880225Z"},"links":{"cited_paper":"/paper/2602.13626","citing_paper":"/paper/2606.10156"},"observation_digest":"sha256:592ba328c7f7ba3c4d22d4832f3882c33c49cded112432e6d81c1d28cf03ca03","observation_id":"d3cb02e2-b7bf-4c48-a437-b37e3cae0f8a","resolution":{"observed_at":"2026-07-01T18:15:58.170863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.13626","snapshot_observed_at":"2026-08-02T11:58:31.994649Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.10156","last_updated":"2026-07-24T21:13:14Z","snapshot_observed_at":"2026-08-06T23:56:02.901369Z","submitted_at":"2026-06-08T20:35:45Z","title":"$\\tau$-Rec: A Verifiable Benchmark for Agentic Recommender Systems","version":3},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T11:58:31.994649Z"},"links":{"cited_paper":"/paper/2602.13626","citing_paper":"/paper/2606.10156"},"observation_digest":"sha256:3cfbb801205a7a22afa5652acfe1ffd2640b247f0bbcd6a920f3005eab0e71d8","observation_id":"7612bacc-3254-44c7-a112-3a1de6b2a54c","resolution":{"observed_at":"2026-08-02T11:58:31.994649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.13626/citation-record","integrity":"/paper/2602.13626/integrity","json":"/paper/2602.13626/citation-record.json","paper":"/paper/2602.13626"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:07.525839Z","title":"Bao and 1 others","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:07.525839Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:1b0fcf2861d36c29a64c8294dbe5cd5f71e0a69d15ef65b3908fea76050b1de6","observation_id":"78718d57-4b8c-4b79-8275-a6c463276475","resolution":{"observed_at":"2026-08-02T23:32:07.525839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-02T23:32:07.585060Z","title":"Hudson, Ehsan Adeli, and 1 others","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:07.585060Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:c033e26fd7f3192e84e65d54c5506eb22aa2d4205bd6fce5a00e9db972648ff6","observation_id":"b22e4e2a-4b60-4484-8953-09d3a89f14f9","resolution":{"observed_at":"2026-08-02T23:32:07.585060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:07.671781Z","title":"Brown, Benjamin Mann, Nick Ryder, and 1 others","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:07.671781Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:cd9132d8b8d5b0683ca6a84c9150669188e50683045e098c1f208fb625de6cc6","observation_id":"bb6d9315-a876-4cb7-a16f-44bcea294c85","resolution":{"observed_at":"2026-08-02T23:32:07.671781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13188","last_updated":"2023-01-30T18:53:09Z","snapshot_observed_at":"2026-08-03T19:59:42.715353Z","submitted_at":"2023-01-30T18:53:09Z","title":"Extracting Training Data from Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13188","snapshot_observed_at":"2026-08-02T23:32:07.748005Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:07.748005Z"},"links":{"cited_paper":"/paper/2301.13188","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:d5168b8f26308f8dc768e42180e23b6f88d6eaed6b11487083a2398ddad27463","observation_id":"97b0acec-3f3b-481d-b9e1-ef935011e457","resolution":{"observed_at":"2026-08-02T23:32:07.748005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-02T23:32:07.827979Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:07.827979Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:6e7230a2ad424053c4a5d61ede4751d896c3d2295781604dd93c28469c5a9e8a","observation_id":"82e01daa-0f77-43be-a41b-92045eb0338d","resolution":{"observed_at":"2026-08-02T23:32:07.827979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:07.924086Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:07.924086Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:3a0a1ff183cff6dd39c80b79ec3ae9f9ba7f44d665a0bc5eb4005132b12fed78","observation_id":"1609db6a-8aa5-4a33-abc0-c4f1808b36d7","resolution":{"observed_at":"2026-08-02T23:32:07.924086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:07.983012Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:07.983012Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:84d8eca598cd8d6af5e2633fffefa177957d532bbab47d615da4eac488ef5804","observation_id":"abf31c7a-2aa3-43b5-80b7-181e08ccd333","resolution":{"observed_at":"2026-08-02T23:32:07.983012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.048334Z","title":"Dai and 1 others","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.048334Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:f3bcc6033b17086d5033f6fe0354a973b801f1a369eb5e963a7dba1d2ee9354a","observation_id":"d7b69852-b8a2-48f1-bb97-c46eb43477e9","resolution":{"observed_at":"2026-08-02T23:32:08.048334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13366","last_updated":"2023-01-02T05:35:41Z","snapshot_observed_at":"2026-08-05T14:50:04.341089Z","submitted_at":"2022-03-24T22:13:23Z","title":"Recommendation as Language Processing (RLP): A Unified Pretrain, Personalized Prompt & Predict Paradigm (P5)","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13366","snapshot_observed_at":"2026-08-02T23:32:08.109768Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.109768Z"},"links":{"cited_paper":"/paper/2203.13366","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:3000410170396aea6371c10362df185f8e5f271a09b8a8bcd54c287397886d45","observation_id":"c5373665-19c8-446c-bab0-9e96a6be1599","resolution":{"observed_at":"2026-08-02T23:32:08.109768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.152611Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.152611Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:9a2cd5583177382a78a9afed5bf4a3c786d59aeb125cee01fe95160a851b6435","observation_id":"6728a6a7-417a-43b8-8025-45d86541cbaf","resolution":{"observed_at":"2026-08-02T23:32:08.152611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.204731Z","title":"Maxwell Harper and Joseph A","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.204731Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:eadb97e5c929caf34781e9f36949471706e4a087d7cee1941b4ef1250069c9dd","observation_id":"1567c083-03c6-427a-adf7-1fd741c36377","resolution":{"observed_at":"2026-08-02T23:32:08.204731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.257571Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.257571Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:01c36de7f5dcfb3a4999011a1c66f82b6fdc170770f65d1b09d7465daeaf733d","observation_id":"f43d454b-aede-445f-b336-0d89ca78c713","resolution":{"observed_at":"2026-08-02T23:32:08.257571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-02T23:32:08.312670Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.312670Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:176b1c64b6addbe7ad407c093f94022f40746a4e3178be60358bde3469c1e35c","observation_id":"0e676142-84e8-4506-b815-7e7f1939b5c8","resolution":{"observed_at":"2026-08-02T23:32:08.312670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-02T23:32:08.373517Z","title":"Brown, and 1 others","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.373517Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:0309360373455020b21a581687fd016f26cbf7fa25566ecd4a5fc9577f366d01","observation_id":"b019ffc7-fbc0-4952-b53f-cbf7452470fc","resolution":{"observed_at":"2026-08-02T23:32:08.373517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.468184Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.468184Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:02931ec350034a986b9921ebeda9989e5c784e5f84d81a1a6507b1e7b3024ecf","observation_id":"f0e4330b-4484-4d6d-ae7a-8213d9dbe946","resolution":{"observed_at":"2026-08-02T23:32:08.468184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01157","last_updated":"2024-03-23T17:05:42Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T12:33:47Z","title":"Large Language Models for Generative Recommendation: A Survey and Visionary Discussions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01157","snapshot_observed_at":"2026-08-02T23:32:08.528769Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.528769Z"},"links":{"cited_paper":"/paper/2309.01157","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:1651d64fd71277b246deefb480d7cca7da69c504a8042f3f57c5b1e1c8e66b0a","observation_id":"ecb050a8-0257-4e34-8338-097494b0bc18","resolution":{"observed_at":"2026-08-02T23:32:08.528769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.582270Z","title":"Li and 1 others","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.582270Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:46c5a1e111db249994f9495daabe16fd4171cef3bef36dcc0289a7efce13982d","observation_id":"f345c3ec-522a-43a8-914e-2ea8974a1a5d","resolution":{"observed_at":"2026-08-02T23:32:08.582270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05817","last_updated":"2024-07-09T13:17:52Z","snapshot_observed_at":"2026-08-05T03:33:18.005396Z","submitted_at":"2023-06-09T11:31:50Z","title":"How Can Recommender Systems Benefit from Large Language Models: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05817","snapshot_observed_at":"2026-08-02T23:32:08.633592Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.633592Z"},"links":{"cited_paper":"/paper/2306.05817","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:80b6d00038979355b97e19286e9b42c671b8e253ef11ca83f15371e6c746042f","observation_id":"95a048c5-68e5-46e1-9721-31a4df91d568","resolution":{"observed_at":"2026-08-02T23:32:08.633592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/tacl_a_00619","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Transactions of the Association for Computational Linguistics","work_id":"36d9e5f2-05b8-4612-9923-cab78e1f7d99","year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.683212Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:88f42ddfb65118a549901a4f1e076977ed41c686d784873ff1da55407374c7ee","observation_id":"961a51a4-c67b-4020-8941-d524c96d2501","resolution":{"observed_at":"2026-08-02T23:33:22.148292Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.737883Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.737883Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:63764f43124d8fff2fafe20f79625c93ae965d05f7811e615886b431a0aed829","observation_id":"4bd4744e-675d-4d21-883d-d42593c6aab3","resolution":{"observed_at":"2026-08-02T23:32:08.737883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.788906Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.788906Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:d67a90bfdc8e4920b6adc32042964d0ff5ae8681eb8a4bc1adbca8851c23e1aa","observation_id":"e2adc434-a3f2-4d66-b4e1-2ecc833da8d6","resolution":{"observed_at":"2026-08-02T23:32:08.788906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:08.845611Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.845611Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:b1e117bad4101466dbf56567ebc7349d075efe14b882c1aa291884a32197cee4","observation_id":"b8d528bf-feb6-4608-8649-c3f743d70518","resolution":{"observed_at":"2026-08-02T23:32:08.845611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-02T23:32:08.929607Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:08.929607Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:d9002638abbb818aa909d34f26747446b8ba5fdfaa20a18e253b59695962903d","observation_id":"0dc51d36-b4f8-43ed-97ec-839ff9f53f6d","resolution":{"observed_at":"2026-08-02T23:32:08.929607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.013968Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.013968Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:24e19a3f8eaf545b876065dcb1bde66921f21e9a99ddc5c191ef34808650de73","observation_id":"62b1b60c-5e85-478e-bf11-db68052f706d","resolution":{"observed_at":"2026-08-02T23:32:09.013968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.096271Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.096271Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:9e33684ad644fc35ac7f9617ed71b910ed489576076bf461d5d6691d378e33f8","observation_id":"a50e9ff4-261b-4d4e-9f1a-44d2b7d8d892","resolution":{"observed_at":"2026-08-02T23:32:09.096271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.158012Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.158012Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:5790f23de350ae6dfeff277f59eb50e2223b2c96a72b01593d3223f984871983","observation_id":"44667a42-6cec-4660-b6bc-a5cd45fe3a12","resolution":{"observed_at":"2026-08-02T23:32:09.158012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-02T23:32:09.210472Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.210472Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:a7fa4f4250c8c7ca6cd70b4d5a17fa95cdaa73a7e69234622521d7e2a7fc9272","observation_id":"0e860959-aecb-4868-baa9-03f25fe64e60","resolution":{"observed_at":"2026-08-02T23:32:09.210472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19744","last_updated":"2024-10-10T08:22:04Z","snapshot_observed_at":"2026-07-31T00:38:55.486087Z","submitted_at":"2024-10-10T08:22:04Z","title":"Towards Next-Generation LLM-based Recommender Systems: A Survey and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19744","snapshot_observed_at":"2026-08-02T23:32:09.261748Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.261748Z"},"links":{"cited_paper":"/paper/2410.19744","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:67ee976cffbc99f66a691ef877295d88804b2f4496b914eec650d6c9eab3222c","observation_id":"aeb14b96-6de8-4e15-9152-44376f435758","resolution":{"observed_at":"2026-08-02T23:32:09.261748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-02T23:32:09.314415Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.314415Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:a94ef75709140084af8344c6006d16f91300f4c3d2d65a57c358e642c5d66709","observation_id":"87c317db-1899-499d-bee1-d32b921a2897","resolution":{"observed_at":"2026-08-02T23:32:09.314415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.401375Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.401375Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:ad5277e6720b8185f36d7e3dec06517b4b31e071eb7e872a4fb151fb02b20e8f","observation_id":"1b357c05-1477-462d-9621-1337b372cd2d","resolution":{"observed_at":"2026-08-02T23:32:09.401375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19860","last_updated":"2024-06-18T08:07:01Z","snapshot_observed_at":"2026-08-02T20:46:35.907732Z","submitted_at":"2023-05-31T13:51:26Z","title":"A Survey on Large Language Models for Recommendation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19860","snapshot_observed_at":"2026-08-02T23:32:09.512965Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.512965Z"},"links":{"cited_paper":"/paper/2305.19860","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:d17ff318291873495475e3b1e790c786963a02110852a0ee459ec8bc5e7a29c4","observation_id":"77a3c461-2420-4c77-ac7c-c04602fd5f20","resolution":{"observed_at":"2026-08-02T23:32:09.512965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.557428Z","title":"Zhang and X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.557428Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:573415f81290067f70bba4dc572c9278af0f6a558040d85d3a772e17982b4b76","observation_id":"f6b4729b-d26c-41d1-916a-48c732b07c29","resolution":{"observed_at":"2026-08-02T23:32:09.557428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03210","last_updated":"2024-06-05T12:45:25Z","snapshot_observed_at":"2026-07-06T18:25:53.102819Z","submitted_at":"2024-06-05T12:45:25Z","title":"Text-like Encoding of Collaborative Information in Large Language Models for Recommendation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03210","snapshot_observed_at":"2026-08-02T23:32:09.610826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.610826Z"},"links":{"cited_paper":"/paper/2406.03210","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:9da9c230ae6ba8f464e77b445463d6d3db0a787e19d4926c1fd19c83b2e37cb9","observation_id":"8cda2482-caf6-4842-bb1e-5b8c701697b1","resolution":{"observed_at":"2026-08-02T23:32:09.610826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.683380Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.683380Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:b8f3191c992de31211b5309d2bb65c5017737f0cf8f5df973f9aaaa9fd652e06","observation_id":"44336350-e57e-49e1-a8ba-1dc569748e80","resolution":{"observed_at":"2026-08-02T23:32:09.683380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.733953Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.733953Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:7e8ef7b644bf5c8830f5555f4311105e0603e954e6f1c89a293e2bf8de6a0a4b","observation_id":"0e23b289-94da-4c96-ad42-f0aa18b19fcc","resolution":{"observed_at":"2026-08-02T23:32:09.733953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01964","last_updated":"2023-11-03T14:59:54Z","snapshot_observed_at":"2026-08-06T10:56:05.075839Z","submitted_at":"2023-11-03T14:59:54Z","title":"Don't Make Your LLM an Evaluation Benchmark Cheater","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01964","snapshot_observed_at":"2026-08-02T23:32:09.809875Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.809875Z"},"links":{"cited_paper":"/paper/2311.01964","citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:0922145c8d09f7580914e6a276e04c107f43f752da1a5f553998aef93e94dd1e","observation_id":"0be77a86-62d8-4578-a0e6-0e23617115be","resolution":{"observed_at":"2026-08-02T23:32:09.809875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.873639Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.873639Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:74bfe85a02776d8d3266226693779282939cd048d1c34d22335b8aabecfdbc65","observation_id":"6b0e2736-48bd-4f46-bb8b-493880b6a378","resolution":{"observed_at":"2026-08-02T23:32:09.873639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:32:09.911061Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T23:32:09.911061Z"},"links":{"citing_paper":"/paper/2602.13626"},"observation_digest":"sha256:b3e380ca1fcf4a847b9c374fcd25b90ac54eb02a299bdbd07558308f0bde8e08","observation_id":"4260e045-cac2-4301-ab3b-b9ff9a2a36e9","resolution":{"observed_at":"2026-08-02T23:32:09.911061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.13626","last_updated":"2026-05-26T14:18:40Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T23:32:06.387048Z","submitted_at":"2026-02-14T06:34:19Z","title":"Benchmark Leakage Trap: Can We Trust LLM-based Recommendation?"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 4 inbound Pith citation observations for arXiv:2602.13626."}