{"as_of":"2026-08-10T06:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f72c07d3c2dad4d3a4c8a4c592c1227bfe84d68be06eacf1d9965c77b413c17","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:29:14.045791Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T03:47:35.690878Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-08-07T14:29:14.045791Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18880","last_updated":"2025-05-24T21:36:49Z","snapshot_observed_at":"2026-08-07T14:21:44.980371Z","submitted_at":"2025-05-24T21:36:49Z","title":"REGen: Multimodal Retrieval-Embedded Generation for Long-to-Short Video Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:14.045791Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2505.18880"},"observation_digest":"sha256:9f52c8e05ea5e0029bd931e9e9a6f27ea3bad1009e00a1a30364e85a5a45a770","observation_id":"0433936a-d9d1-4d8a-a280-72766676c584","resolution":{"observed_at":"2026-08-07T14:29:14.045791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-08-06T22:44:53.255664Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20817","last_updated":"2026-02-15T19:09:27Z","snapshot_observed_at":"2026-08-09T11:25:00.822362Z","submitted_at":"2025-06-25T20:32:12Z","title":"RAG-VisualRec: An Open Resource for Vision- and Text-Enhanced Retrieval-Augmented Generation in Recommendation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:44:53.255664Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2506.20817"},"observation_digest":"sha256:ec1f49d53c1a963b0709bee0322d3f20b26ed09ee35f59c85138e145e32b8316","observation_id":"9d33fdb6-dbd7-4f14-85b8-8af1915b79ae","resolution":{"observed_at":"2026-08-06T22:44:53.255664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-08-06T00:52:20.947043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04206","last_updated":"2025-08-06T08:39:07Z","snapshot_observed_at":"2026-08-06T00:52:13.896523Z","submitted_at":"2025-08-06T08:39:07Z","title":"ViLLA-MMBench: A Unified Benchmark Suite for LLM-Augmented Multimodal Movie Recommendation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:52:20.947043Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2508.04206"},"observation_digest":"sha256:1a500b3bac153c794b7c88909a1329c82dc7e2bf47f78c14ed10840482bdcd34","observation_id":"bf739d6f-05fd-40e5-bf9b-2567a8531986","resolution":{"observed_at":"2026-08-06T00:52:20.947043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2402.08670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-07-03T03:47:35.690878Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models","venue":null,"work_id":"b5f5a615-8c8c-4630-9090-f124752bc8e7","year":2024},"citing_paper":{"arxiv_id":"2510.27157","last_updated":"2026-05-09T03:19:23Z","snapshot_observed_at":"2026-08-02T06:54:15.933170Z","submitted_at":"2025-10-31T04:02:58Z","title":"A Survey on Generative Recommendation: Data, Model, and Tasks","version":2},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-05-18T03:47:08.208082Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2510.27157"},"observation_digest":"sha256:bbadc0e9bdb463d6b6b2032fae69f4275d83c1972e0ef05e18158eae843ef61d","observation_id":"f3e2742e-08d1-44f6-a583-a34889447b78","resolution":{"observed_at":"2026-05-18T03:50:51.982452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-08-03T22:12:44.510309Z","title":"Rec-gpt4v: Multimodal recommendation with large vision- language models.arXiv preprint arXiv:2402.08670, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.12035","last_updated":"2026-07-21T06:26:07Z","snapshot_observed_at":"2026-08-08T23:56:39.865292Z","submitted_at":"2025-11-15T05:07:31Z","title":"Timeripple: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T22:12:44.510309Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2511.12035"},"observation_digest":"sha256:31d30b7a152a88c45d049270569cd7299135bde745b5d3ae514457a24ea9e54b","observation_id":"2871a6b5-c309-4703-a1dc-e008b13dc720","resolution":{"observed_at":"2026-08-03T22:12:44.510309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2402.08670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-07-03T03:47:35.690878Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models","venue":null,"work_id":"b5f5a615-8c8c-4630-9090-f124752bc8e7","year":2024},"citing_paper":{"arxiv_id":"2511.18740","last_updated":"2026-04-07T02:21:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T04:10:46Z","title":"Multimodal Large Language Models with Adaptive Preference Optimization for Sequential Recommendation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T06:16:53.140133Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2511.18740"},"observation_digest":"sha256:56b9a746c686db0c6860922d87f0e2599dcc09b7a9d5d04f9379222458f7977d","observation_id":"7c9e4ad9-71ea-4b6b-9a04-4448460489cd","resolution":{"observed_at":"2026-05-17T06:19:09.826762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2402.08670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-07-03T03:47:35.690878Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models","venue":null,"work_id":"b5f5a615-8c8c-4630-9090-f124752bc8e7","year":2024},"citing_paper":{"arxiv_id":"2512.21863","last_updated":"2026-05-05T01:52:29Z","snapshot_observed_at":"2026-08-02T05:58:57.454693Z","submitted_at":"2025-12-26T04:56:28Z","title":"Frozen LVLMs for Micro-Video Recommendation: A Systematic Study of Feature Extraction and Fusion","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T20:09:45.442172Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2512.21863"},"observation_digest":"sha256:a5688f1c663f64bb4d254177ac01edec45b94f8be59db919834e6e809a76e85b","observation_id":"34a2ac48-1407-46ee-a8bf-d52b7aec0837","resolution":{"observed_at":"2026-05-16T20:11:13.440417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-08-03T09:54:29.234625Z","title":"Fredrik Nestaas, Edoardo Debenedetti, and Florian Tramèr","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.12263","last_updated":"2026-06-07T22:07:41Z","snapshot_observed_at":"2026-08-09T10:05:51.082655Z","submitted_at":"2026-01-18T04:58:28Z","title":"Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T09:54:29.234625Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2601.12263"},"observation_digest":"sha256:65703860fe326f72c52705601a05d6f3ea6c725204b4cf21917463b85080297d","observation_id":"6755ffc3-da50-47f0-834b-b0a193a223ef","resolution":{"observed_at":"2026-08-03T09:54:29.234625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-08-03T06:01:36.678015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.00682","last_updated":"2026-05-25T17:41:39Z","snapshot_observed_at":"2026-08-04T10:44:28.584379Z","submitted_at":"2026-01-31T11:58:38Z","title":"RecGOAT: Graph Optimal Adaptive Transport for LLM-Enhanced Multimodal Recommendation with Dual Semantic Alignment","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T06:01:36.678015Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2602.00682"},"observation_digest":"sha256:b7f7611b80b4f22d3e04b55d6b37d59ec5ba018dfcfd8b37ae42f8bb56b18520","observation_id":"46d7228a-5ada-4a28-8e4b-1b4bea9765fa","resolution":{"observed_at":"2026-08-03T06:01:36.678015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2402.08670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-07-03T03:47:35.690878Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models","venue":null,"work_id":"b5f5a615-8c8c-4630-9090-f124752bc8e7","year":2024},"citing_paper":{"arxiv_id":"2604.26247","last_updated":"2026-04-29T03:04:43Z","snapshot_observed_at":"2026-08-08T21:13:18.093935Z","submitted_at":"2026-04-29T03:04:43Z","title":"TimeMM: Time-as-Operator Spectral Filtering for Dynamic Multimodal Recommendation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-07T12:54:56.401350Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2604.26247"},"observation_digest":"sha256:f305cd8c9c01286bbddfffaae68c8a556d3a9077fcdf9ecac72e51ad040a5b58","observation_id":"e17f65a3-4179-40d0-9524-8d096f297189","resolution":{"observed_at":"2026-05-12T09:06:26.097461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2402.08670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-07-03T03:47:35.690878Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models","venue":null,"work_id":"b5f5a615-8c8c-4630-9090-f124752bc8e7","year":2024},"citing_paper":{"arxiv_id":"2605.15203","last_updated":"2026-04-03T01:53:05Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-04-03T01:53:05Z","title":"Agent4POI: Agentic Context-Conditioned Affordance Reasoning for Multimodal Point-of-Interest Recommendation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T17:36:33.004577Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2605.15203"},"observation_digest":"sha256:a56e98d860d0e03512ca9be155b145c651b5943580ba9ef6e490abdd592fc48f","observation_id":"0df56292-c49d-4d32-8800-b7ad80052d00","resolution":{"observed_at":"2026-05-19T17:37:41.401097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2402.08670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-07-03T03:47:35.690878Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models","venue":null,"work_id":"b5f5a615-8c8c-4630-9090-f124752bc8e7","year":2024},"citing_paper":{"arxiv_id":"2605.26941","last_updated":"2026-05-26T12:31:48Z","snapshot_observed_at":"2026-07-06T23:36:43.912215Z","submitted_at":"2026-05-26T12:31:48Z","title":"The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T15:49:45.212333Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2605.26941"},"observation_digest":"sha256:698f1f0b41b1b8390905024585a15cb9154269bd25122fc6dc96208dab9c9136","observation_id":"5ee6975e-0442-4c6d-8667-fbdee60a8529","resolution":{"observed_at":"2026-06-29T16:23:39.956120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2402.08670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08670","snapshot_observed_at":"2026-07-03T03:47:35.690878Z","title":"Rec-gpt4v: Multimodal recommendation with large vision-language models","venue":null,"work_id":"b5f5a615-8c8c-4630-9090-f124752bc8e7","year":2024},"citing_paper":{"arxiv_id":"2606.09595","last_updated":"2026-06-08T15:06:06Z","snapshot_observed_at":"2026-08-09T11:25:23.864348Z","submitted_at":"2026-06-08T15:06:06Z","title":"Popcorn: A Configurable Benchmark for Visual Evidence in Multimodal Movie Recommendation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T14:42:10.975540Z"},"links":{"cited_paper":"/paper/2402.08670","citing_paper":"/paper/2606.09595"},"observation_digest":"sha256:c97aea3f39e0594ff798cfc1e49ad0e5470f95a5b6825a424b8f12bfe3abbaff","observation_id":"21581710-ad7f-429e-8d65-b10585e2b104","resolution":{"observed_at":"2026-07-03T03:47:35.692763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.08670/citation-record","integrity":"/paper/2402.08670/integrity","json":"/paper/2402.08670/citation-record.json","paper":"/paper/2402.08670"},"outbound":[],"paper":{"arxiv_id":"2402.08670","last_updated":"2024-02-13T18:51:18Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T21:43:18.364114Z","submitted_at":"2024-02-13T18:51:18Z","title":"Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2402.08670."}