{"as_of":"2026-08-04T07:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a00b0780a907199449c0ac5f2f0954c412d7965a9a07e5db14ac0baa9856dd64","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T20:25:17.992009Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T03:11:54.775186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.20136","snapshot_observed_at":"2026-07-31T03:11:54.775186Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28580","last_updated":"2026-07-30T17:40:05Z","snapshot_observed_at":"2026-08-03T00:12:32.151225Z","submitted_at":"2026-07-30T17:40:05Z","title":"DualG-MRAG: Decoupling Macro-Reasoning and Micro-Matching for Multimodal Retrieval-Augmented Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T03:11:54.775186Z"},"links":{"cited_paper":"/paper/2512.20136","citing_paper":"/paper/2607.28580"},"observation_digest":"sha256:3914ebf670c0b3f8d2b77be74dfa6f9b94e95687346575157f785c17ea1e04d3","observation_id":"1ac6d1cd-77ac-4133-9142-06e9b910f280","resolution":{"observed_at":"2026-07-31T03:11:54.775186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.20136/citation-record","integrity":"/paper/2512.20136/integrity","json":"/paper/2512.20136/citation-record.json","paper":"/paper/2512.20136"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:ae63486b96c43e483a85e831a5cf68322732121e01229736f4c57f5787337d27","observation_id":"ebc71ff2-319b-4a28-8497-2478cbb06f5b","resolution":{"observed_at":"2026-05-16T20:28:24.265540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"9e4f2109-fff0-4d7c-a335-1dbae7ddbc85","year":2022},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:d7446b24a3aadfcbf0312b479bb6e016851968f8edd5c82d6a81f620ac2ab084","observation_id":"01c7122a-7e81-4877-a351-1dfe881994b6","resolution":{"observed_at":"2026-05-17T01:21:25.502459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":"2305.10403","doi":"10.48550/arxiv.2305.10403","metadata_source":"pith","pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-07-10T13:57:07.008081Z","title":"PaLM 2 Technical Report","venue":"cs.CL","work_id":"905ee9a7-ea61-4a94-bd62-2600cbe3e315","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:17164e53e7750efa96437c7bbed83e3a15c8ed9727ecf866af1c390cf5815a66","observation_id":"ac01c28e-30b9-4935-af8d-d00e0c6b83fe","resolution":{"observed_at":"2026-05-16T20:28:24.258269Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reflective multi- agent collaboration based on large language models.Ad- vances in Neural Information Processing Systems, 37:138595– 138631","venue":null,"work_id":"d8ecb1a4-a4cf-4f95-961e-acc6d8fa2fd9","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:e2a98beeff4c42c927c70c395405ba18f669f6139ac2a4372d2335ecd79df3ea","observation_id":"3d806be5-de41-453a-a211-155ff6441061","resolution":{"observed_at":"2026-05-17T01:21:25.498766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving language models by retriev- ing from trillions of tokens","venue":null,"work_id":"f57a8beb-6261-4470-b5a7-6e57dcaaccc6","year":2022},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:b43fd701d612629ff40ed67f7bd6107807ffb6304bf711b81bd7eae96378dacc","observation_id":"f5d1ac21-263c-48cb-a25e-21ac944aecbd","resolution":{"observed_at":"2026-05-17T01:21:25.510613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Activitynet: A large-scale video bench- mark for human activity understanding","venue":null,"work_id":"e8f62dd9-3977-4e4e-9c51-248c1deacd63","year":2015},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:422e3c21af7a1a24093280a25ed458db1dfa8f02ffd1d51d2fc6bc4d8d946f07","observation_id":"0b157ab0-a520-497b-837a-34fb38287fd8","resolution":{"observed_at":"2026-05-17T01:21:25.559049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vggsound: A large-scale audio-visual dataset","venue":null,"work_id":"45d9da50-fd41-4c2f-97d3-f5f519418b15","year":2020},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:85045d8f64de50f7e5908301efd6b18b529237d16ef729476bff8637be75f5e9","observation_id":"3628fb65-e495-4341-bb6d-2d35fc8dc40f","resolution":{"observed_at":"2026-05-17T01:21:25.526616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":"2406.07476","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-07-04T16:49:57.279303Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","venue":"cs.CV","work_id":"ccfc3f89-c510-45f1-8a35-ed1a56c0ae5c","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:800e9bb1523a88b2a82d34878b5c91b8e8a942ef7e552a02adf7c5f8cb99ba4b","observation_id":"66d8fc06-43f1-4723-b18b-46a7dff9a9c5","resolution":{"observed_at":"2026-05-16T20:28:24.262237Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18425","last_updated":"2025-04-25T15:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-25T15:31:46Z","title":"Kimi-Audio Technical Report","version":1},"cited_work":{"arxiv_id":"2504.18425","doi":"10.48550/arxiv.2504.18425","metadata_source":"pith","pith_arxiv_id":"2504.18425","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Kimi-Audio Technical Report","venue":"eess.AS","work_id":"9c2ba56b-5585-4f28-b751-703f31dca2d5","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2504.18425","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:c2cf30145c3001bd72a46f8ee0232074a2aef7bc5c52f1d0a71d918e16c17906","observation_id":"17a1a4e2-e901-466a-a145-e7c44e24a1e0","resolution":{"observed_at":"2026-05-16T20:28:24.269283Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The llama 3 herd of models.arXiv e-prints, pages arXiv–2407","venue":null,"work_id":"7b4584e0-efef-4cfc-928a-61b1400bae6f","year":null},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:3273c69f86d46ea09737494c4282bba892ac954cdea5ad2c646fb4fa65b8b992","observation_id":"2bd43eac-8385-4758-ab82-9b0c06ce13fa","resolution":{"observed_at":"2026-05-17T01:21:25.522361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"cited_work":{"arxiv_id":"2404.16130","doi":"10.48550/arxiv.2404.16130","metadata_source":"pith","pith_arxiv_id":"2404.16130","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","venue":"cs.CL","work_id":"588618d7-fd41-4053-b34d-a981f8793039","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2404.16130","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:3e8d7013693d54d1031a532f4279a73ccca1acd851f6afd109f302b37c64c890","observation_id":"eb62cacc-468e-4310-8528-48266d70e890","resolution":{"observed_at":"2026-05-16T20:28:24.220989Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A sur- vey on rag meeting llms: Towards retrieval-augmented large language models","venue":null,"work_id":"e345775d-f4ec-466f-ade5-921c77278818","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:282c7aa0f7cc220f0153d03e84a8dbc27dff5c37cbdb02a47b84a45238d2b41d","observation_id":"a999c17f-170f-4c42-a97b-b6bf7cb49eea","resolution":{"observed_at":"2026-05-17T01:21:25.545059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Precise zero-shot dense retrieval without relevance labels","venue":null,"work_id":"b7447866-f0e9-4a93-a133-8dede905437c","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:6d4048c14363b4e96b1584f2a00ad3ab5ac1091daddcede0c5ac93715244dbf9","observation_id":"be601260-7efe-46b2-b5b9-d19ffd62c988","resolution":{"observed_at":"2026-05-17T01:21:25.529297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemmeke, Daniel P","venue":null,"work_id":"ef8d81cc-1d1b-4d86-ac87-63bd1de1c368","year":2017},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:ea6a37f69515bcb5fe78e580e027d9dbca51b60fb54b33ca4bdb7fe7a83eba80","observation_id":"16f9baef-e03b-415f-be5f-d082e9b2f90d","resolution":{"observed_at":"2026-05-17T01:21:25.534559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recap: Retrieval- augmented audio captioning","venue":null,"work_id":"8036d22d-1b9c-486d-b655-f53577487a77","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:a186349c11b8043733ed6635f6da585977a818b909bc4122d87318138d4617f9","observation_id":"05c97855-fd89-4dbe-8748-630fdbd1235e","resolution":{"observed_at":"2026-05-17T01:21:25.518467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:33ee4dd6a5937ddb4552d69e1fdcafe0d51b678fe1458429f49de01b4772be4a","observation_id":"7e6f03c9-d710-4731-9bb6-5bf1c2b7dbae","resolution":{"observed_at":"2026-05-16T20:28:24.217526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:580119d519f6bd4adf47f6a95302c624893f9aa1d96d1eae6d2670fa171cb96d","observation_id":"90eaa30a-3dc2-421e-8163-1e0d1e4eb8ce","resolution":{"observed_at":"2026-05-16T20:28:24.210683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LightRAG: Simple and fast retrieval-augmented gen- eration","venue":null,"work_id":"fd3e8208-e3f7-4bf1-861a-4e6016fca979","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:dbea442bb80a647afb5cdad43296262b72e48481a64d9d929cabbd3a0b4ebe73","observation_id":"fade3ec8-69bd-4cea-a632-4796c00f10d4","resolution":{"observed_at":"2026-05-17T01:21:25.542813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1, 2, 6, 4","venue":null,"work_id":"06983eb4-c060-4fbc-9655-7d30541684b4","year":null},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:a6dc329d5e36aea23ffeb8bd20877906aa3b3f16e69d2c721afcb6eb7e1c72d8","observation_id":"db5ea8c2-97cb-4bb4-b9b2-0e3058a42460","resolution":{"observed_at":"2026-05-17T01:21:25.530872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From RAG to memory: Non-parametric continual learning for large language models","venue":null,"work_id":"9835b91c-db93-4dc8-9938-f01088cccffc","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:2e40ba1cd236ac2e97f3d51d44e2eb37b7be3928673abcb9efaf29f28618f4fa","observation_id":"9b4754f4-fa6a-43c9-9e69-528e4cc7a23b","resolution":{"observed_at":"2026-05-17T01:21:25.596502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Realm: retrieval-augmented language model pre-training","venue":null,"work_id":"00f6cf72-10bc-4a6f-befd-197b302d9e25","year":2020},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:8d6d3123d291f6aa69c898274e11282cc8272b1d55fd6aa9c45819b6bc916771","observation_id":"13d65aaf-45a3-46f1-b499-77a449869c30","resolution":{"observed_at":"2026-05-17T01:21:25.549699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:83aeab3720426e57c26b829beded5d615566625ef990459f8c90d00fa6a64818","observation_id":"ff1badcb-8211-41d2-88e5-8a15bd1340f4","resolution":{"observed_at":"2026-05-16T20:28:24.234443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.01282","last_updated":"2021-02-03T09:18:34Z","snapshot_observed_at":"2026-08-03T22:53:08.799163Z","submitted_at":"2020-07-02T17:44:57Z","title":"Leveraging Passage Retrieval with Generative Models for Open Domain Question Answering","version":2},"cited_work":{"arxiv_id":"2007.01282","doi":"10.48550/arxiv.2007.01282","metadata_source":"pith","pith_arxiv_id":"2007.01282","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Leveraging Passage Retrieval with Generative Models for Open Domain Question Answering","venue":"cs.CL","work_id":"0b308f70-d137-45f1-9add-47a9566c1f99","year":2020},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2007.01282","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:54529909f09338fcda7692ec0e4ceea5792bec1295d678a3f72fdc0939178cb8","observation_id":"5f59d159-b01e-489e-9ec7-cc11c16596b9","resolution":{"observed_at":"2026-05-17T12:49:05.460002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VideoRAG: Retrieval-augmented generation over video corpus","venue":null,"work_id":"fd093c43-8a01-4da5-a555-b771fffac2a6","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:d65bfbb21d12b2237f1c37d367fcc2fb877b0add0dbfe22cddc443debf93e800","observation_id":"efd35ec6-d71b-4fb9-b12d-7ad98d8b43b5","resolution":{"observed_at":"2026-05-17T01:21:25.508862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Billion-scale similarity search with gpus.IEEE Transactions on Big Data, 7(3):535–547","venue":null,"work_id":"f463f4c3-a8d4-4a65-ae9f-3ea30efd02d7","year":2019},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:5d1c1d65962c4057c7b65017263b6fd182dbd77c1d4a0da4383c1d40b103394f","observation_id":"3873a045-b778-4f88-88bd-46b136797b74","resolution":{"observed_at":"2026-05-17T01:21:25.536907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audiocaps: Generating captions for audios in the wild","venue":null,"work_id":"1d71d313-cfb6-43b0-8f94-33fb33b977db","year":2019},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:f3d5364a31a1736b8746c407a9ac1fbe688075ddf7c3ac9115973acfdf2e1739","observation_id":"171d9ac2-4559-4bde-aef4-0b9a9c91cae9","resolution":{"observed_at":"2026-05-17T01:21:25.500648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vista: Visual-textual knowledge graph representation learning","venue":null,"work_id":"1b780373-7d41-4dc1-a2f7-252be575e721","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:8c61a5667ea6ed1d61abbe5653525b905eb6022fc4a7f6c7ca667835ad351074","observation_id":"3616e33c-4a6c-4932-82b0-88746133997b","resolution":{"observed_at":"2026-05-17T01:21:25.491304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02030","last_updated":"2024-06-05T03:28:01Z","snapshot_observed_at":"2026-07-30T11:51:28.081152Z","submitted_at":"2024-06-04T07:13:23Z","title":"Multimodal Reasoning with Multimodal Knowledge Graph","version":2},"cited_work":{"arxiv_id":"2406.02030","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02030","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi- modal reasoning with multimodal knowledge graph","venue":null,"work_id":"1045c158-270c-4d89-9c04-98b984408b21","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2406.02030","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:87f243b7df55ccb853269dcfad54d69807f1d76f4d3cfdf5f916cf546a6d04ae","observation_id":"0104258a-cce6-44cb-8bee-d25ed7c7864e","resolution":{"observed_at":"2026-05-16T20:28:24.207309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks.Ad- vances in Neural Information Processing Systems, 33:9459– 9474","venue":null,"work_id":"a2783a76-8437-4fbf-a842-0e14c1744d15","year":2020},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:208a09a9f6bb64567aa52fe23618f1124bfc68168647c0472d894bedcb29972f","observation_id":"cad07230-741b-4873-afcf-010b89c2d03c","resolution":{"observed_at":"2026-05-17T01:21:25.547169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-07-10T13:27:05.574543Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:f60db944885d9124c3cbce77204679d0c93aa71329b82009c86a02dbe254dcd2","observation_id":"febaa49d-ec5e-4d4b-80f8-0c5e54940461","resolution":{"observed_at":"2026-05-16T20:28:24.251519Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LLaV A-neXT- interleave: Tackling multi-image, video, and 3d in large mul- timodal models","venue":null,"work_id":"76526202-471b-4cbe-907e-21beccf6afa6","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:fd3dc0d9e9e6e54dd2aa87c7ed47273de4e5655c3b2310c711c61c9561df9515","observation_id":"0a78cc6a-bf21-4150-8576-b4cd8d77157d","resolution":{"observed_at":"2026-05-17T01:21:25.490100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blip- 2: bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"a7e26e0a-93e7-4581-9a60-aad597307e57","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:c7fc547f6fa022a380a592a564440f3c6c638c32c20eedf941c3c733d7675573","observation_id":"a0e2be57-b18e-4b8a-88f2-9e32f423fa52","resolution":{"observed_at":"2026-05-17T01:21:25.577568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual instruction tuning","venue":null,"work_id":"69b3f86c-c300-40ac-bc2b-6efe5f5755b0","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:b03d6e3e75f7feae8a8130dabfba8efde753393338935bd74d38b5c7b7431eb8","observation_id":"c81b54ef-41af-4d25-ab60-c02569ce7b6e","resolution":{"observed_at":"2026-05-17T01:21:25.579926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Valor: Vision-audio- language omni-perception pretraining model and dataset","venue":null,"work_id":"a04ee808-dfce-494a-a2bd-c9030d9f0b83","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:45fd702fdcd24d5296ea680adc38de627a2b6efd4a563600ec8e7fa73115b63e","observation_id":"d23aff66-2564-4f95-b5b1-be69231c341d","resolution":{"observed_at":"2026-05-17T01:21:25.554939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aligning vision to language: Annotation-free multimodal knowledge graph construction for enhanced llms reasoning","venue":null,"work_id":"98a8e799-f1b8-4f94-91d6-18c837877c6c","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:2d5ff5a633b99e438df61b4a93b7298a723e32a2137389d0eef4ef4f091a6dfb","observation_id":"f1b6f107-a39f-4d35-92ba-bcc8c4af9fdd","resolution":{"observed_at":"2026-05-17T01:21:25.497186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"41889d92-9274-44f4-858a-df199635e848","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:4a0b8c2a536d8dcacc0c643dbcdb4debffbd8ce77fcb7f0db52d36927de1503c","observation_id":"d64e4f6c-adfd-4d9d-a61b-0a86101133c0","resolution":{"observed_at":"2026-05-17T01:21:25.563246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-chatgpt: Towards detailed video un- derstanding via large vision and language models","venue":null,"work_id":"7d83d23d-3ee2-4cf9-a8b6-d66b1dc9f2b6","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:4db1e443cd2c57c592034fdc9ac3789b59bab3cc4fea8585957cecb9f6d5aa0f","observation_id":"f0191c5b-aef7-4af7-8d78-624d16505200","resolution":{"observed_at":"2026-05-17T01:21:25.567377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.21556","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vat-kg: Knowledge-intensive multimodal knowl- edge graph dataset for retrieval-augmented generation","venue":null,"work_id":"d1d1c241-989d-4ee2-a0b8-d22c15e86fbb","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:c30ec49bf71c58563c512466ceecdd43c57de79ec9e04b44409f2c30bb210ef2","observation_id":"5b40edea-6589-489b-97fe-bed2b8995da7","resolution":{"observed_at":"2026-05-16T20:28:24.203969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"80f109ce-6254-4c1b-933f-5ce1d4917269","year":2021},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:96f8a0346691fa319d588429d8b8d20b2f5b656ae5cd9e3ad2ab267032cf93e5","observation_id":"1a95fa81-f997-4363-99ca-1965f646a01f","resolution":{"observed_at":"2026-05-17T01:21:25.472471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accept the modality gap: An exploration in the hyperbolic space","venue":null,"work_id":"3700bd1e-4258-4510-9019-39db1d8b3b2a","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:9ea1adefba2361cb0e689e822913d45d89bae6792afecce35aec0b33891c47fb","observation_id":"ee02ce6a-c3a4-4670-a90e-0edcae3362ac","resolution":{"observed_at":"2026-05-17T01:21:25.478819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01549","last_updated":"2025-02-03T17:30:19Z","snapshot_observed_at":"2026-07-06T20:30:22.267038Z","submitted_at":"2025-02-03T17:30:19Z","title":"VideoRAG: Retrieval-Augmented Generation with Extreme Long-Context Videos","version":1},"cited_work":{"arxiv_id":"2502.01549","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01549","snapshot_observed_at":"2026-07-04T16:09:57.163337Z","title":"Videorag: Retrieval-augmented gen- eration with extreme long-context videos","venue":null,"work_id":"c527235a-ac49-4199-96f6-e9b9188b4c98","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2502.01549","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:8a2504fcdaa3a9af4b394228f6785912066e1ea805b0621989d2816a4f8a49ff","observation_id":"6fb04597-f0d8-4ea7-b587-a965539b72a1","resolution":{"observed_at":"2026-05-16T20:28:24.244972Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00054","last_updated":"2025-05-28T22:57:04Z","snapshot_observed_at":"2026-08-04T00:29:41.271306Z","submitted_at":"2025-05-28T22:57:04Z","title":"Retrieval-Augmented Generation: A Comprehensive Survey of Architectures, Enhancements, and Robustness Frontiers","version":1},"cited_work":{"arxiv_id":"2506.00054","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00054","snapshot_observed_at":"2026-07-11T00:47:43.559746Z","title":"arXiv preprint arXiv:2506.00054 , year=","venue":"cs.IR","work_id":"36ce46d9-8b9c-41ec-bc69-b9d867496c13","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2506.00054","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:e589713ace452ec74c6663393f7bc5dea17a67c25e7fba0de92ef90c8d40ca0f","observation_id":"330b2476-5970-4725-a9d2-c44bc26f5d1c","resolution":{"observed_at":"2026-05-16T20:28:24.241113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.13289","doi":"10.1016/j.ajhg.2009.06.010","metadata_source":"pith","pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","venue":"cs.SD","work_id":"b06d6def-ea7a-4cbd-8bb3-73f6a81db238","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:ade1fb5ba77ea0311c6c77152da2c9b7d6d4b26a288737fe41f7d2079a01ded4","observation_id":"2ea44df0-79b2-4af5-b8f2-11a8cfd4c88a","resolution":{"observed_at":"2026-05-18T02:29:46.683133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:f1eda5456a9fc0fd15ed76f1b1725aa265e0eb4cc49f8864cfbf29c58289fc03","observation_id":"74e20f80-5d56-4a03-8af0-8d2b05932104","resolution":{"observed_at":"2026-05-16T20:28:24.187836Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06322","last_updated":"2025-01-10T19:56:50Z","snapshot_observed_at":"2026-07-30T22:07:13.869232Z","submitted_at":"2025-01-10T19:56:50Z","title":"Multi-Agent Collaboration Mechanisms: A Survey of LLMs","version":1},"cited_work":{"arxiv_id":"2501.06322","doi":"10.48550/arxiv.2501.06322","metadata_source":"pith","pith_arxiv_id":"2501.06322","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Multi-Agent Collaboration Mechanisms: A Survey of LLMs","venue":"cs.AI","work_id":"34627f75-81fe-465e-bca5-d2a93270aa1d","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2501.06322","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:bc4273d8847da89e95f89439b2eba33bb41885ebbad452381199b223f999802b","observation_id":"d4bc0700-3728-435e-b9dd-3646eee0b222","resolution":{"observed_at":"2026-05-16T20:28:24.191023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:24.614742+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:24.614742+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audiobench: A universal benchmark for audio large language models","venue":null,"work_id":"105a24e2-c670-45b5-ae00-67acfa3df66a","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:8a9513809a6646c1ed2dd0c641df1512896a829b00ed93e8794c5c83314eeeba","observation_id":"b8f2eff0-467a-4585-b54d-525701fff4bf","resolution":{"observed_at":"2026-05-17T01:21:25.570947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kepler: A unified model for knowledge embedding and pre-trained lan- guage representation.Transactions of the Association for Computational Linguistics, 9:176–194","venue":null,"work_id":"6296d199-4812-46d9-9b5e-6c454a765510","year":2021},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:9b635bffe7f8254cc3bd0b2da587cacf538ec313607c412a412e755dd7db0690","observation_id":"efbf87df-353b-4bae-904b-4948c44fc270","resolution":{"observed_at":"2026-05-17T01:21:25.467335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Internvideo2: Scaling foundation models for mul- timodal video understanding","venue":null,"work_id":"b726d688-2062-46d9-9c38-5fdd5df64c85","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:6207461567f1cfb0fc784a30f66c4f3708f93cf7cc8fd4762e83f50601f579aa","observation_id":"e357d86e-f27e-469b-b969-f2402bb632bb","resolution":{"observed_at":"2026-05-17T01:21:25.574241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large-scale con- 10 trastive language-audio pretraining with feature fusion and keyword-to-caption augmentation","venue":null,"work_id":"f39482de-8e5c-45cc-8e18-6ef715c7f683","year":2023},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:a3c714fa61e4d7cc991e06e96cfed3f040f10b358c95d72527ccdd64cf535b87","observation_id":"9bc6fa6b-fa7e-4a4f-874c-47ad5c2c48ef","resolution":{"observed_at":"2026-05-17T01:21:25.475629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-03T04:23:51.274879Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2503.20215","doi":"10.48550/arxiv.2503.20215","metadata_source":"pith","pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Qwen2.5-Omni Technical Report","venue":"cs.CL","work_id":"438f105c-fa9b-44aa-ad52-43acb8045cda","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:6cdf14b139d51f9a52ac5b29fda26067dcccd8aed4c2e8244979bef2e093d78f","observation_id":"188ee25a-d08a-4aaf-913c-ea9854d41d6a","resolution":{"observed_at":"2026-05-16T20:28:24.193908Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2509.17765","doi":"10.48550/arxiv.2509.17765","metadata_source":"pith","pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Qwen3-Omni Technical Report","venue":"cs.CL","work_id":"ae43e594-8bab-4471-b6af-92a300f6a048","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:7f6df6f8778c56adf7c99fcdc2497850b29e82c6576150a2de22b707e240e0ce","observation_id":"1273e86d-6d85-45ee-9fa5-390eef4c42ba","resolution":{"observed_at":"2026-05-16T20:28:24.248350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards weakly supervised text-to-audio grounding.IEEE Transac- tions on Multimedia","venue":null,"work_id":"e958e2c4-c618-4b90-a448-3974e6cb9254","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:9a76f014dd83fb8e18b2a318c6e18a45b9b1643b7d5596ce6b198bd2debc27a2","observation_id":"8e8e55f7-fa37-42cd-8562-5e7d4a864ed7","resolution":{"observed_at":"2026-05-17T01:21:25.506632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:a295aaea1f89637b5d85f8b900a22451a70abcf4fd944d53a05befedea235ee6","observation_id":"fd5b61c6-309c-47d6-848f-1f678949a7c8","resolution":{"observed_at":"2026-05-16T20:28:24.231638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":"2408.01800","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-07-10T11:37:03.161139Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","venue":"cs.CV","work_id":"0f06e436-0c76-4e3c-be5e-6168f6bc4336","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:b2e697592e0189c0c426e72f08c834a888a75e60e3b847667d2881520a26d8ff","observation_id":"669ead28-4e11-4136-96c9-e40aeaa34652","resolution":{"observed_at":"2026-05-16T20:28:24.237628Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20734","last_updated":"2026-05-18T05:53:24Z","snapshot_observed_at":"2026-07-06T21:16:27.689435Z","submitted_at":"2025-04-29T13:18:58Z","title":"UniversalRAG: Retrieval-Augmented Generation over Corpora of Diverse Modalities and Granularities","version":4},"cited_work":{"arxiv_id":"2504.20734","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.20734","snapshot_observed_at":"2026-07-03T05:57:41.622468Z","title":"UniversalRAG: Retrieval-Augmented Generation over Corpora of Diverse Modalities and Granularities","venue":"cs.CL","work_id":"e9f6e2c1-6f10-4e7d-bc92-a68b93b2bdc5","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"cited_paper":"/paper/2504.20734","citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:63c7e03c8cfafe669c0dec3a043ae814bfb4ac380663948ef2b502f1b54bd9bb","observation_id":"545b065d-d6c2-48d6-9371-e382bf36434e","resolution":{"observed_at":"2026-05-20T00:04:08.732725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M2conceptbase: A fine-grained aligned concept-centric multimodal knowledge base","venue":null,"work_id":"5bd03a1d-1e51-4033-85d7-10dd9e4d640b","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:75308a3f97ec3ca31cacda93d2a74da0bfbfb8083de75925ab72ee7da8b16e9c","observation_id":"5d802b19-69e6-48f5-b875-d35a6ab86319","resolution":{"observed_at":"2026-05-17T01:21:25.538153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extract, define, canonicalize: An llm-based framework for knowledge graph construction","venue":null,"work_id":"34e5bbe2-e2c4-437a-8fb9-a00dc9dc6ef5","year":2024},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:25b5ccfcc1adfe58a69a9a2c447a7e8c1e79db1c3a483c65647b2c3cf2b02019","observation_id":"a4a1f017-2af4-47e1-8f6c-57967a49eae6","resolution":{"observed_at":"2026-05-17T01:21:25.582595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.13958","doi":"10.48550/arxiv.2501.13958","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A survey of graph retrieval-augmented generation for customized large language models","venue":null,"work_id":"dad5820a-e704-43fd-99fb-0c3dcd8fcbbb","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:263e12a9f903238ea6359a0789826f44e014d2346d3ab20e262a8fca8a501b02","observation_id":"f26c989e-ae64-444d-83f1-6a9a6caf0fbe","resolution":{"observed_at":"2026-05-16T20:28:24.224621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"dogs”→“dog","venue":null,"work_id":"1ff2a809-a2fa-4f89-829a-01099f0fe921","year":2025},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:12bd1c0069daf120d5aa60ed689f3f1fa89fcd11c5053524043832269decabed","observation_id":"e364adb5-8a67-4636-b742-b3a6124340b0","resolution":{"observed_at":"2026-05-17T01:21:25.585083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"61cc84ee-6a47-4bf5-8e88-27ea710f9f63","year":null},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:266602ed9d039c332acea1e214aae71889228e5144e8bf43ad8d9a52cc335092","observation_id":"c1ec6a64-2a89-4114-8a30-ed8bb9e44d8a","resolution":{"observed_at":"2026-05-17T01:21:25.587781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"– Do NOT contradict the primary evidence; if conflict exists, ignore the triple","venue":null,"work_id":"bbc7e094-e8a4-4489-bc35-a9dda20a7064","year":null},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:2ce14f9e81d5c46436e253bf8c4e1a3f60ec180b987b182b2670fcc8f7756266","observation_id":"ce6755d8-8e4a-4f38-83ed-4ea65e0ff0a5","resolution":{"observed_at":"2026-05-17T01:21:25.590736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8741.0840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Query : {QUERY} Retrieved Triples : {TRIPLES_BLOCK} Triple Format : [i] head={h} | relation={r} | tail={t} || head_description={hd} | tail_description={td} Answer : Table 13","venue":null,"work_id":"8749ddc5-2152-4543-9787-c0d5ffb5553c","year":null},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:da3e4cdce8ae68ca9f5bb46b1300365dc70092ae5bf85b17a2f051f435b32d78","observation_id":"cc5b0d66-6dee-49cf-ac7a-e1b7ae20a331","resolution":{"observed_at":"2026-05-16T20:28:24.228279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6542.9944","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d09ed9a5-fdf0-4829-9819-1b920ddc0eb2","year":null},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:7721810c65e8a73cc421ed0be02fde60d183c88106e7fa22621963b5a01e21a8","observation_id":"89d0a112-df36-4569-995e-62d449123e4d","resolution":{"observed_at":"2026-05-16T20:28:24.255076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The audio contains the sound of a bird chirping","venue":null,"work_id":"5eeb3000-a418-4b65-9cdb-1ea0b2ea915b","year":null},"citing_paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:17.992009Z"},"links":{"citing_paper":"/paper/2512.20136"},"observation_digest":"sha256:dc109adf2277a4c93c0d1be1d0a20b0c0e92aab3f8a88b3c707239ec35371861","observation_id":"47b36e24-9673-4a99-9eac-42beba4e4cd4","resolution":{"observed_at":"2026-05-17T01:21:25.594022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.20136","last_updated":"2026-04-13T03:03:06Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T22:39:52.837578Z","submitted_at":"2025-12-23T07:54:03Z","title":"M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":25,"verified_fuzzy":38},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 1 inbound Pith citation observation for arXiv:2512.20136."}