{"as_of":"2026-08-07T00:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7e45a8ff86d26c299b684301d796094741587bc25a90668fdefb9050ac1caf0","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:24:24.931453Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:13:40.751517Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T11:13:44.946863Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"cited_work":{"arxiv_id":"2508.21354","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.21354","snapshot_observed_at":"2026-08-05T11:13:44.946863Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","venue":"cs.IR","work_id":"c33c4b87-c06b-44ac-b0e8-e9d3449d226c","year":2025},"citing_paper":{"arxiv_id":"2509.03131","last_updated":"2025-09-03T08:33:43Z","snapshot_observed_at":"2026-08-05T11:13:31.171618Z","submitted_at":"2025-09-03T08:33:43Z","title":"RecBase: Generative Foundation Model Pretraining for Zero-Shot Recommendation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T11:13:40.751517Z"},"links":{"cited_paper":"/paper/2508.21354","citing_paper":"/paper/2509.03131"},"observation_digest":"sha256:66993e93228143a88550a192e86b7d955d43b87a787eede3b446adf68f636de6","observation_id":"7917368b-6bf0-4154-9537-afc4211d5087","resolution":{"observed_at":"2026-08-05T11:13:45.012281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.21354/citation-record","integrity":"/paper/2508.21354/integrity","json":"/paper/2508.21354/citation-record.json","paper":"/paper/2508.21354"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-05T14:24:22.828300Z","title":"Tallrec: An effective and efficient tuning framework to align large language model with recommendation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:22.828300Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:852ddcb2a00a093907eacfe9ab7a59d4299de0e2761805c04ef4d85adb78710e","observation_id":"cd24d7a3-d9bd-47c5-a2a5-2d5fe33d308c","resolution":{"observed_at":"2026-08-05T14:24:22.828300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11094","last_updated":"2025-03-01T19:27:41Z","snapshot_observed_at":"2026-08-04T08:35:16.203643Z","submitted_at":"2024-02-16T21:47:30Z","title":"Revisiting Word Embeddings in the LLM Era","version":3},"cited_work":{"arxiv_id":"2402.11094","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11094","snapshot_observed_at":"2026-08-05T14:24:26.464099Z","title":"Revisiting Word Embeddings in the LLM Era","venue":"cs.CL","work_id":"a80dec38-bcff-483d-a0b5-147a88ecfa51","year":2024},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.159373Z"},"links":{"cited_paper":"/paper/2402.11094","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:c3be6d58a0704a359c37a7dc4686025b9ebc42b05ddb9dc60131834c14846390","observation_id":"4ffbc0a2-0e72-47ba-bb8b-f99f0203fbcf","resolution":{"observed_at":"2026-08-05T14:24:26.533314Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:27.492730Z","title":"Cross-domain recom- mendation via cluster-level latent factor model","venue":null,"work_id":"0b33ebe1-b491-4ed6-aafb-81c1178070b3","year":2013},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.275635Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:f7097c7ff62807eede04468d37b06e8a3873e3f9bbba4e68526d6042ed9ffc1c","observation_id":"296096be-3a16-4b79-840c-d3833d029893","resolution":{"observed_at":"2026-08-05T14:24:27.565748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.03300","last_updated":"2021-05-07T14:52:06Z","snapshot_observed_at":"2026-07-06T11:07:14.961043Z","submitted_at":"2021-05-07T14:52:06Z","title":"DA-GCN: A Domain-aware Attentive Graph Convolution Network for Shared-account Cross-domain Sequential Recommendation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.03300","snapshot_observed_at":"2026-08-05T14:24:23.416343Z","title":"Da-gcn: A domain-aware attentive graph convolution network for shared-account cross-domain sequential recommendation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.416343Z"},"links":{"cited_paper":"/paper/2105.03300","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:13fa5e6badcc5794ac7c89f52436b073bd3b8c33392f90f04a7a7455a7cab4ba","observation_id":"432d37dd-ca8b-43d2-a880-e5b918dbd239","resolution":{"observed_at":"2026-08-05T14:24:23.416343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00331","last_updated":"2024-11-01T03:09:28Z","snapshot_observed_at":"2026-07-06T19:43:23.653382Z","submitted_at":"2024-11-01T03:09:28Z","title":"Beyond Utility: Evaluating LLM as Recommender","version":1},"cited_work":{"arxiv_id":"2411.00331","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.00331","snapshot_observed_at":"2026-08-05T14:24:26.149296Z","title":"Beyond Utility: Evaluating LLM as Recommender","venue":"cs.IR","work_id":"e84b4c29-f59b-43e4-ae40-477c71398487","year":2024},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.572582Z"},"links":{"cited_paper":"/paper/2411.00331","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:f1621159fddc596beaeafe2b9ee61b127079579df0913a053dcd23b6b88cabf0","observation_id":"f0fe05b8-c40f-4c3b-a1e0-261ca3f49549","resolution":{"observed_at":"2026-08-05T14:24:26.199987Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-05T14:24:23.656589Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.656589Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:3e3978015ba961b8838884a163a37d83433000784f5a220032fe210b5168984c","observation_id":"270f586d-2c70-4437-8379-e1536549d8de","resolution":{"observed_at":"2026-08-05T14:24:23.656589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.10697","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:25.907155Z","title":"Language model evolutionary algorithms for recommender systems: Benchmarks and algorithm comparisons","venue":null,"work_id":"865bc395-9281-449e-ade2-cedf6e0b0745","year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.756481Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:5f60d4a438275870ac3a9ea390d84d2b575dea1f566bc6a4445fdb2e9cda2bcd","observation_id":"454176b1-a7b8-4305-8ce7-604688e57b73","resolution":{"observed_at":"2026-08-05T14:24:25.989145Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07276","last_updated":"2025-08-05T11:07:31Z","snapshot_observed_at":"2026-08-03T19:39:09.508662Z","submitted_at":"2024-09-11T13:49:48Z","title":"Learning Multi-Aspect Item Palette: A Semantic Tokenization Framework for Generative Recommendation","version":3},"cited_work":{"arxiv_id":"2409.07276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.07276","snapshot_observed_at":"2026-08-05T14:24:25.623951Z","title":"Learning Multi-Aspect Item Palette: A Semantic Tokenization Framework for Generative Recommendation","venue":"cs.IR","work_id":"2ffe586a-d632-4790-a08f-6fd8bbc36e52","year":2024},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.831866Z"},"links":{"cited_paper":"/paper/2409.07276","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:8ffe28beb18447667752d3c051c8bd584d039678939b7c499d81c6e1efcf9bc5","observation_id":"2a9a03a3-f8ef-43f0-a594-fd31154bfae9","resolution":{"observed_at":"2026-08-05T14:24:25.704029Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:27.199699Z","title":"Hoang Ngo and Dat Quoc Nguyen","venue":null,"work_id":"75a58cfa-7c42-405c-bfda-7e5dd1a8c770","year":2025},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.884903Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:457753b4c25789aa02eec3fbec315c96d93effa2dbae1654e0a0bebd37ff4b12","observation_id":"9e86968c-dee9-44df-a41b-9302cd6da27a","resolution":{"observed_at":"2026-08-05T14:24:27.276982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-05T14:24:23.949796Z","title":"Large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.949796Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:8387987c1266cb92f4b2a8f88f59cbb7aa77f25dea4f6d249b6ea3c5e6674246","observation_id":"7f9fe0d4-2ca8-44b0-8a74-9eaad73f86f8","resolution":{"observed_at":"2026-08-05T14:24:23.949796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T14:24:24.033316Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.033316Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:aec9a008620c2b1a0c8a13c23836cad836d23b72a1f69e242d75e76cbd7eff48","observation_id":"7062efb2-2a0d-41e8-9090-ee26b38ceb14","resolution":{"observed_at":"2026-08-05T14:24:24.033316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13112","last_updated":"2023-11-03T02:49:46Z","snapshot_observed_at":"2026-07-06T15:30:42.173342Z","submitted_at":"2023-05-22T15:12:43Z","title":"Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13112","snapshot_observed_at":"2026-08-05T14:24:24.104785Z","title":"Rethinking the evaluation for conversational recommendation in the era of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.104785Z"},"links":{"cited_paper":"/paper/2305.13112","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:d864490a60520ca5a3a5c9412fab4c883ca832ae8e6fa0116d09c75625439c59","observation_id":"43b18f6b-b4c0-4bd1-bf96-58f60edd7fd0","resolution":{"observed_at":"2026-08-05T14:24:24.104785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-05T14:24:24.212069Z","title":"Huggingface’s transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.212069Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:eba33440663494da87168e549d7b17dddba82df42793cd063dc857be73e87ada","observation_id":"c220245a-184c-45d5-8b9e-9a3026985f8d","resolution":{"observed_at":"2026-08-05T14:24:24.212069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:27.032983Z","title":"A survey on large language models for recommendation","venue":null,"work_id":"abd3b325-3451-4950-b5af-385a1a1e4f14","year":2024},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.389531Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:4afff560b34a816ecb134f0c948bdfe6b66a6ec059ade2f085a2718e1b15addf","observation_id":"f450759c-f499-4202-95d5-92069a023be1","resolution":{"observed_at":"2026-08-05T14:24:27.054082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T14:24:24.498733Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.498733Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:a3402b71f2f64c171699768be40e18bf755ac1f1ddf10584ce8a52609f0ddbf2","observation_id":"ce3d5b05-4cbc-44e8-bf90-2cef063a2978","resolution":{"observed_at":"2026-08-05T14:24:24.498733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-05T14:24:24.573508Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.573508Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:5c5e516faaf388135031cd7b1efaeac7c917594d9191d24f67742457e6cb667b","observation_id":"8d44194c-7aa7-4aea-87a4-2607d83c1327","resolution":{"observed_at":"2026-08-05T14:24:24.573508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:26.848759Z","title":"Language models as recommender systems: Evalua- tions and limitations","venue":null,"work_id":"07fb954a-614d-4bbb-8cd2-a4082fab6e55","year":2021},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.669460Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:71dd06938954c942c86ccef9e75426c04608465b64940a1bfc915febdd45bb12","observation_id":"0d9488c5-7796-4d58-b948-62ae9841d120","resolution":{"observed_at":"2026-08-05T14:24:26.915899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:24.745262Z","title":"2024.3392335","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.745262Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:fc1b1dd8c8175eb11566d42c6c278642bec3983fda822e4e9d674a00ae801269","observation_id":"4ccaed1e-689a-4b7d-a60e-30461996e99f","resolution":{"observed_at":"2026-08-05T14:24:24.745262Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:26.680526Z","title":"C.2 Additional Evaluation Metrics In the main text, we report only the AUC metric due to the space constraints","venue":null,"work_id":"bff865bd-e8b1-4274-a5a2-97eb9d2097cb","year":1903},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.931453Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:5d88abefb6583b46ee3afdf5560e9b8c86eb6ca5831fda6e892036fe6042826f","observation_id":"a8439bf3-dacb-4a59-ac3b-b03c0dad99a3","resolution":{"observed_at":"2026-08-05T14:24:26.757690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T14:24:23.081553Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.081553Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:535485f7f88ceb91e2fad7f4550cbf3a61f84767d01347fb9bec5d2ac4e4c4e0","observation_id":"68d16a66-1a19-4ee6-b588-dac23a91fb01","resolution":{"observed_at":"2026-08-05T14:24:23.081553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09874","last_updated":"2025-02-09T12:44:58Z","snapshot_observed_at":"2026-08-03T21:53:06.256822Z","submitted_at":"2023-10-15T16:15:07Z","title":"TF-DCon: Leveraging Large Language Models (LLMs) to Empower Training-Free Dataset Condensation for Content-Based Recommendation","version":5},"cited_work":{"arxiv_id":"2310.09874","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.09874","snapshot_observed_at":"2026-08-05T14:24:25.309217Z","title":"TF-DCon: Leveraging Large Language Models (LLMs) to Empower Training-Free Dataset Condensation for Content-Based Recommendation","venue":"cs.IR","work_id":"7c505e6c-d7ef-49b1-921b-fbc6650f9a61","year":2023},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.302375Z"},"links":{"cited_paper":"/paper/2310.09874","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:bc4df84eb6dcc2c64defd5acd5b9731adbf37d82cabe3c760675e03ae0974f85","observation_id":"97fffeb3-4241-456c-ab68-8a4ad6d3a7f6","resolution":{"observed_at":"2026-08-05T14:24:25.361532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-05T14:24:23.352696Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.352696Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:740de28e05c50e570b6c1553e62f40af37742ce9c6c5aeeb8e7aa0ae8a5cd033","observation_id":"354ee563-3200-4764-b97d-13d036a6ca52","resolution":{"observed_at":"2026-08-05T14:24:23.352696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T14:24:23.504111Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:23.504111Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:e6070e5d8fd156939348dea3923ac89848ecd6982d284e030d9a06e694bf945a","observation_id":"b2974f55-6519-4442-9380-10258ce9dce8","resolution":{"observed_at":"2026-08-05T14:24:23.504111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:24:27.694870Z","title":"Differential private knowledge transfer for privacy-preserving cross-domain recommendation","venue":null,"work_id":"5f0ebc57-0fd9-4934-9325-571eef26f246","year":2022},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:22.981848Z"},"links":{"citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:537ef665f444897a4c4f460b9ba4ddc988cd6b889bb6f48f1b28626e0ef64f21","observation_id":"541190a3-df68-4da1-bc0b-d6ba231267ea","resolution":{"observed_at":"2026-08-05T14:24:27.760426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01696","last_updated":"2021-03-02T12:58:08Z","snapshot_observed_at":"2026-07-06T10:46:01.808404Z","submitted_at":"2021-03-02T12:58:08Z","title":"Cross-Domain Recommendation: Challenges, Progress, and Prospects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.01696","snapshot_observed_at":"2026-08-05T14:24:24.858493Z","title":"Cross-domain recommendation: challenges, progress, and prospects","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:24.858493Z"},"links":{"cited_paper":"/paper/2103.01696","citing_paper":"/paper/2508.21354"},"observation_digest":"sha256:1c78485c14d1ab24bf402c4a30f0295f7e42d1445181f39394f067e606d71d9d","observation_id":"4e87e01f-a252-41e5-98a9-84c7adacf045","resolution":{"observed_at":"2026-08-05T14:24:24.858493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.21354","last_updated":"2025-08-29T06:40:52Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-05T14:24:20.177683Z","submitted_at":"2025-08-29T06:40:52Z","title":"Evaluating Recabilities of Foundation Models: A Multi-Domain, Multi-Dataset Benchmark"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":4,"verified_fuzzy":6},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2508.21354."}