{"as_of":"2026-08-19T00:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:31476e72eb7ac80b0757fe320b75c11544c42f23ee3e4f39b02cec73d05a1bfb","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:52:40.939692Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:32:58.993527Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T12:32:59.674227Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"cited_work":{"arxiv_id":"2505.03654","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03654","snapshot_observed_at":"2026-08-16T12:32:59.674227Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","venue":"cs.CV","work_id":"b8816321-49ef-4167-ae39-07acb3f7fbae","year":2025},"citing_paper":{"arxiv_id":"2504.12574","last_updated":"2025-08-26T13:04:59Z","snapshot_observed_at":"2026-08-17T20:03:52.814620Z","submitted_at":"2025-04-17T01:44:57Z","title":"ForgetMe: Evaluating Selective Forgetting in Generative Models","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:58.993527Z"},"links":{"cited_paper":"/paper/2505.03654","citing_paper":"/paper/2504.12574"},"observation_digest":"sha256:3193f138e095cd9fc52b413595b0ea8cc24bcdcc58d45704a5f5a9aed5137726","observation_id":"8a5c3cd4-da04-4a02-b79c-ad64a7c590e2","resolution":{"observed_at":"2026-08-16T12:32:59.699182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03654/citation-record","integrity":"/paper/2505.03654/integrity","json":"/paper/2505.03654/citation-record.json","paper":"/paper/2505.03654"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T23:52:40.769618Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.769618Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:6f99db9e51d13cd646bf09c9b9efa4e4c91fec8bf98502e245e17ecc222f3741","observation_id":"0a96ea49-222e-453f-aba3-10f287fb557c","resolution":{"observed_at":"2026-08-15T23:52:40.769618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.774651Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.774651Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:91d9e91091281e27d7f2d5ce72f1fc016ad566987c8f27a15180690154364e30","observation_id":"8174b8e9-e694-495a-99d9-40e1cac0fc7c","resolution":{"observed_at":"2026-08-15T23:52:40.774651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-15T23:52:40.778865Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.778865Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:a97ec5ceefb523c47fac930c7058f7f9b5d853296ef1c03e54d9f59e23248868","observation_id":"23105bea-b7d8-4c22-919b-54417c62941f","resolution":{"observed_at":"2026-08-15T23:52:40.778865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.782613Z","title":"Minigpt-4: Enhanc- ing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.782613Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:ad8f01006a2629113532bdb1e956d1946e544283bb538371141fd3169bef1d11","observation_id":"2ef19879-9ab9-4ae1-8003-3d5d1a6f28e8","resolution":{"observed_at":"2026-08-15T23:52:40.782613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.462149Z","title":"Yo'llava: Your personalized language and vision assistant","venue":null,"work_id":"d3a386d3-ff46-425d-a08a-c882ec2c2759","year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.786454Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:e7d2f38cfc57d574a983ff896c398b2cf9dd4c23af5ea6100271224b58df8256","observation_id":"65c5f750-50e3-49a9-a2b2-1043989eb8e2","resolution":{"observed_at":"2026-08-15T23:52:41.466783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02142","last_updated":"2024-12-03T03:59:03Z","snapshot_observed_at":"2026-08-17T00:46:43.443375Z","submitted_at":"2024-12-03T03:59:03Z","title":"Personalized Multimodal Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02142","snapshot_observed_at":"2026-08-15T23:52:40.790647Z","title":"Personalized multimodal large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.790647Z"},"links":{"cited_paper":"/paper/2412.02142","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:4d52f3e85ef46653ca48ba7967d8856991599342b86c545cf68cde68ddca7c5a","observation_id":"4854716d-9d40-4c11-ae71-9630be705ec8","resolution":{"observed_at":"2026-08-15T23:52:40.790647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17610","last_updated":"2024-12-23T14:29:41Z","snapshot_observed_at":"2026-08-19T00:26:35.789182Z","submitted_at":"2024-12-23T14:29:41Z","title":"Personalized Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17610","snapshot_observed_at":"2026-08-15T23:52:40.795444Z","title":"Personalized large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.795444Z"},"links":{"cited_paper":"/paper/2412.17610","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:8541a151945a2e2669c33262e74d9f38e47accdbd7b30fd0375c349eef0d7dd1","observation_id":"bed49222-304f-4da7-819e-915a8261bdb6","resolution":{"observed_at":"2026-08-15T23:52:40.795444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13360","last_updated":"2025-03-28T17:28:44Z","snapshot_observed_at":"2026-08-19T00:27:30.738356Z","submitted_at":"2024-10-17T09:10:26Z","title":"RAP: Retrieval-Augmented Personalization for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13360","snapshot_observed_at":"2026-08-15T23:52:40.799830Z","title":"Remember, retrieve and generate: Understanding infinite visual concepts as your personalized assistant","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.799830Z"},"links":{"cited_paper":"/paper/2410.13360","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:5e4fafc16c7bd6646d5d2ac86a569e2ad5a1cd050fd4b24e923928ae82a8302b","observation_id":"cd67abcd-61bb-4b99-9386-18c597ec08dc","resolution":{"observed_at":"2026-08-15T23:52:40.799830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.448466Z","title":"Myvlm: Personalizing vlms for user-specific queries","venue":null,"work_id":"69fe2fb3-ca6d-46b0-a454-06c7947e5753","year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.804050Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:b787ab22a0a740ecb0bb5276af169069bd2b00c92b451c7073b895072701a526","observation_id":"a23b295b-4717-4c7c-af6f-62c7c0f60b9e","resolution":{"observed_at":"2026-08-15T23:52:41.452948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.433159Z","title":"Structure-mapping: A theoretical framework for analogy","venue":null,"work_id":"2c2c2fec-d3e5-4405-973d-2961e8ec166e","year":1983},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.808821Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:48e809e817c132efe03ea7645eda0938c26dc2af4400299c8b6f75cba0fb38e1","observation_id":"096e2c65-32d2-440c-857f-422329e5fe04","resolution":{"observed_at":"2026-08-15T23:52:41.438190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.422289Z","title":"Aminoff, Shira Baror, Eric W","venue":null,"work_id":"128a8530-6041-43a2-a0c9-d733eeed4903","year":2022},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.812840Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:1b2b8712b10b869dee2dd27b39637b79074d80aa2ded76855695dd2667963a9d","observation_id":"6aecfbda-805e-4c67-8b6b-bd4af15ed7d0","resolution":{"observed_at":"2026-08-15T23:52:41.426145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.407694Z","title":"Llava-sg: Leveraging scene graphs as visual semantic expression in vision-language models","venue":null,"work_id":"69a0d1ae-b56e-4607-a5d6-e962ed69fa37","year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.816287Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:6c50a7c3187ecb073c1be81946fd5cbe768d23119189ff3cc177c4e0fa26de81","observation_id":"11b73a60-da5b-40ee-894f-115300b94ff0","resolution":{"observed_at":"2026-08-15T23:52:41.412576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.394639Z","title":"Llava needs more knowledge: Retrieval augmented natural language generation with knowledge graph for explaining thoracic pathologies","venue":null,"work_id":"c7d01649-b72f-4d2e-9811-2d52fc617ce2","year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.819661Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:f43f32b8d4e92b143fb30c48edfdf94ed9e01edae7b7e8c9f24ec263f8a98d3d","observation_id":"1d448a91-472a-4548-bb78-8a878dfa1a52","resolution":{"observed_at":"2026-08-15T23:52:41.398373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.823821Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.823821Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:e86fade61bef2df3a70822fb0df40e104b0966a487dafee4604ae66f13b74def","observation_id":"27bddb3b-d04e-4eed-b61e-76614625bb64","resolution":{"observed_at":"2026-08-15T23:52:40.823821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-15T17:00:20.282987Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-15T23:52:40.827498Z","title":"Llava-o1: Let vision language models reason step-by-step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.827498Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:dd93ba32f530e42c0e72d38964f2d81950f2875ea2445555891edbb39ff942a9","observation_id":"488d873d-c57d-4bdc-a38d-a9482a5abac0","resolution":{"observed_at":"2026-08-15T23:52:40.827498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.376884Z","title":"Demystifying long chain-of-thought reasoning in LLMs","venue":null,"work_id":"b6639984-f5c1-4b1f-8908-529ff7dca12b","year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.831829Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:e043402bd9f53158403fbf02ee1fd50be73401995ce6f8facedc4aaff8aacd09","observation_id":"3c51a0e1-05c3-4db9-b90d-cf7fc0325c34","resolution":{"observed_at":"2026-08-15T23:52:41.381035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T23:52:40.835024Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.835024Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:348022eef5cfa2c4ef352180622a4e24c755c552bd679437bfcc16fbf4f92d7d","observation_id":"25d6e065-f0f2-4139-9bbd-463547845211","resolution":{"observed_at":"2026-08-15T23:52:40.835024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.364516Z","title":"Towards visual-prompt temporal answer ground- ing in instructional video","venue":null,"work_id":"df76d4a7-8ec2-4e5d-a38e-4f8aed0ee589","year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.839061Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:2b18bb23e54b18e22719b9637c07b964889547df88cb82dcb2aaa38dba4bbdce","observation_id":"f18139b5-954f-4f82-8936-28771ae9e06f","resolution":{"observed_at":"2026-08-15T23:52:41.368644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.353020Z","title":"Large language models with holistically thought could be better doctors","venue":null,"work_id":"11277403-ad23-4cc2-8136-42cbf6d60052","year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.842403Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:a2e4d88b8540faf3e2574061575b7cab8caff7fc73a48726460d94d174c73107","observation_id":"a6363fa3-b5f0-46d8-b888-697b3be5951c","resolution":{"observed_at":"2026-08-15T23:52:41.356863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T23:52:40.845802Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.845802Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:486eb770cf49e9ad7ea55663d9bdcd6c2725f4c5efe8c0a43c01b814a4797e2e","observation_id":"bd39bb44-3dc9-4395-a4f2-392292a263ea","resolution":{"observed_at":"2026-08-15T23:52:40.845802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.850551Z","title":"Gpt-4 technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.850551Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:260cf0710188c90bbf67dd85847a94d141166c00cbc8f8d945e8c2c40b55aa08","observation_id":"0ccdc1ee-1c40-4215-8bc0-b31b9f4a3ff6","resolution":{"observed_at":"2026-08-15T23:52:40.850551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-15T23:52:40.855396Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.855396Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:8c8f6b778f76f9fb411dc81615bfc6e0286b45a7a0270d099277f8f848cdac20","observation_id":"e14c06e2-8e81-4baf-bbda-1e12b3b3b2f1","resolution":{"observed_at":"2026-08-15T23:52:40.855396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.333048Z","title":"Hello again! llm-powered personalized agent for long-term dialogue","venue":null,"work_id":"d873d08b-d7a8-4b42-b3b0-8f171804aa8c","year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.859750Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:6da69d3d30af90bb98252cbf06e8a0d2241cec742faf20eb55980d8f3682e3d6","observation_id":"2f478839-f16a-4511-af59-109ce0880436","resolution":{"observed_at":"2026-08-15T23:52:41.336979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.18623","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.103610Z","title":"Training- free personalization via retrieval and reasoning on fingerprints.arXiv preprint arXiv:2503.18623, 2025","venue":null,"work_id":"85beaa89-5e23-45e8-9a4a-a33dea1e5e9c","year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.863740Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:8bf4ebc0b88952f6c0abbe21c00e0eb94c231486bb5444c28972ae4f0f23f333","observation_id":"d0f21d51-02f2-44fe-b745-6dd86f1ae1d7","resolution":{"observed_at":"2026-08-15T23:52:41.113060Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02452","last_updated":"2026-04-28T16:36:23Z","snapshot_observed_at":"2026-08-13T14:55:17.874754Z","submitted_at":"2025-02-04T16:19:20Z","title":"Personalization Toolkit: Training Free Personalization of Large Vision Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02452","snapshot_observed_at":"2026-08-15T23:52:40.867191Z","title":"Personaliza- tion toolkit: Training free personalization of large vision language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.867191Z"},"links":{"cited_paper":"/paper/2502.02452","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:5c7cbefc580ff1fa9ddfd50a464553e382a2ecda413d36c0f76d8db4cb7de6dd","observation_id":"08ff4971-add3-4cd1-9faf-3cbc1f66ca21","resolution":{"observed_at":"2026-08-15T23:52:40.867191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12999","last_updated":"2026-07-09T14:02:00Z","snapshot_observed_at":"2026-08-16T12:49:25.822510Z","submitted_at":"2025-03-17T09:55:01Z","title":"Concept-as-Tree: A Controllable Synthetic Data Framework Makes Stronger Personalized VLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12999","snapshot_observed_at":"2026-08-15T23:52:40.871705Z","title":"Concept-as-tree: Synthetic data is all you need for vlm personalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.871705Z"},"links":{"cited_paper":"/paper/2503.12999","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:5bc1404b0d13a086162426862458dc70a7f0cf91d835e3de75aafc9e7148e223","observation_id":"eb5cf4f2-006d-40d9-9a75-b96a6541f965","resolution":{"observed_at":"2026-08-15T23:52:40.871705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-15T23:52:40.875643Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.875643Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:7c112f458dd6d7dae56b52d72d774c633e82d729a7bd18ab2403dbd071540750","observation_id":"ab9cec80-6e72-46ad-abb3-877a6630473d","resolution":{"observed_at":"2026-08-15T23:52:40.875643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.879812Z","title":"You only look once: Unified, real-time object detection","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.879812Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:3da738f1b6a12e885b9050a794efbeea617069286ad06ee8b22863b165d11185","observation_id":"af2204ec-fb1d-467f-88c8-a231dcced142","resolution":{"observed_at":"2026-08-15T23:52:40.879812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-15T23:52:40.883481Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.883481Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:c1b911c3d8d16acae67f1d135588fa22c835ac0124c4ab8e43d7782bb4e6d096","observation_id":"6a51152c-fdf1-4a9c-9de9-dbf79b8536c6","resolution":{"observed_at":"2026-08-15T23:52:40.883481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.888764Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.888764Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:c45ef6134f160e0dcd055f2204338745e329ea069d2a7e2f882b4fdf2be445dd","observation_id":"bafbefe2-e088-45b6-b112-0a4a45cb4377","resolution":{"observed_at":"2026-08-15T23:52:40.888764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T23:52:40.892950Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.892950Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:f3cf15d8b6356dbda8b1cf0d75e26e1370f54b386497a33ac6f48a1818311ba8","observation_id":"3738fffc-9714-4a57-afce-092c14f681db","resolution":{"observed_at":"2026-08-15T23:52:40.892950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.305322Z","title":"Llava-v1.6-vicuna-7b","venue":null,"work_id":"eeb072ad-9160-4fb4-8446-796d63f718e5","year":2023},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.897534Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:db198844a3ef2133de6769919390725e12d1645abaeaa5b03a7c9d78d652c364","observation_id":"eb41a424-7ddc-4cbe-901d-a9c4e118c38b","resolution":{"observed_at":"2026-08-15T23:52:41.310389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-15T23:52:40.901682Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.901682Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:3c5a65103c10517c8f9f7735802e9802372ebe2f4bfda3e9b26a2f9bb69ce624","observation_id":"79109081-9a91-49f6-9546-5d5516a5249f","resolution":{"observed_at":"2026-08-15T23:52:40.901682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.906231Z","title":"Qwen2.5-vl, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.906231Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:9b2e917ee17f13a509961339f26746cdbb8f27329785a087d271d132aecf3006","observation_id":"78c9234d-a63d-4c26-b2a2-5eae4f1f3413","resolution":{"observed_at":"2026-08-15T23:52:40.906231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.911305Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.911305Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:8c7ffc68b6e5775c7703f6b60acb95e43f5f08fbe46c03a6199ec43f15618cb0","observation_id":"adf28e2c-d8c3-4f44-9072-daed12724bb3","resolution":{"observed_at":"2026-08-15T23:52:40.911305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.280915Z","title":"Qwen2.5-vl-72b","venue":null,"work_id":"8f4f4067-fcdd-47af-a4a7-c1b9003e44d6","year":2025},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.915761Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:2f3d03873832e22c25753db9e35883e7f9b73ec56e0adc69cead7cc140cd52aa","observation_id":"81d84fdc-55b9-4d0a-93ae-e328b74f5a5e","resolution":{"observed_at":"2026-08-15T23:52:41.284411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.267800Z","title":"Long is more for alignment: A simple but tough-to-beat baseline for instruction fine-tuning","venue":null,"work_id":"8573d0be-fc99-461e-817c-c3e0d7035112","year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.919875Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:4fce1ea882ae184cb7f0d74df3bcaa1bfed512f54f88057cf55c85ec750a40d8","observation_id":"3d1faccf-52d0-4692-8bd4-cb46ff631b7f","resolution":{"observed_at":"2026-08-15T23:52:41.272249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.923341Z","title":"Multimodal chain-of-thought reasoning in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.923341Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:a4950016af1708ac0c2b366cb79d0a0bf73a441793c12686af7ffaa264836aa4","observation_id":"85d57d9d-7960-4eb6-ae74-d9c9cf070a7d","resolution":{"observed_at":"2026-08-15T23:52:40.923341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.927247Z","title":"Compositional chain-of- thought prompting for large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.927247Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:1a94fc083bb19314da931acd2cb67c8d052b4b8e3eb67f8b0a22800043dabe8e","observation_id":"236b4415-3f29-496d-a9ab-13d0f2ab1411","resolution":{"observed_at":"2026-08-15T23:52:40.927247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.931222Z","title":"Visual cot: Advancing multi-modal language models with a comprehensive dataset and benchmark for chain-of-thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.931222Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:aaff56027497dfea95972dd8d3fd2c46a85bb9f749840dce8b0dad836e6c2eed","observation_id":"54267626-2da5-4f77-945c-68cc84a1419d","resolution":{"observed_at":"2026-08-15T23:52:40.931222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:40.935546Z","title":"Kam-cot: Knowledge augmented multimodal chain-of-thoughts reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.935546Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:76579bc200e08a215597dbe999fded0e8c068b493b8701d556fce631014e6423","observation_id":"a712fcd2-cac6-4ccb-90f3-1e27fb2499e5","resolution":{"observed_at":"2026-08-15T23:52:40.935546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:52:41.228521Z","title":"response 1 is better","venue":null,"work_id":"c0a2cda7-4d32-42da-b94f-5ff13cb69793","year":2024},"citing_paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.939692Z"},"links":{"citing_paper":"/paper/2505.03654"},"observation_digest":"sha256:8f308d3b7be782369a27703cbded46bf11e8a5bfe62dabea770b4facb6bef653","observation_id":"fc293896-24ca-45dc-9db3-3f5cd741d9c5","resolution":{"observed_at":"2026-08-15T23:52:41.232224Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.03654","last_updated":"2025-05-19T08:25:06Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T00:25:46.340224Z","submitted_at":"2025-05-06T16:00:13Z","title":"ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.03654."}