{"as_of":"2026-08-22T04:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:88e415629b321e00b9eaf96191fe343d58710567650c5ddfb122b30fa4c0ef5b","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:06:52.211786Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13631/citation-record","integrity":"/paper/2504.13631/integrity","json":"/paper/2504.13631/citation-record.json","paper":"/paper/2504.13631"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05391","last_updated":"2024-02-26T09:57:12Z","snapshot_observed_at":"2026-08-19T02:18:22.454755Z","submitted_at":"2024-02-08T04:04:36Z","title":"Knowledge Graphs Meet Multi-Modal Learning: A Comprehensive Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05391","snapshot_observed_at":"2026-08-16T12:06:52.092909Z","title":"Knowledge graphs meet multi-modal learning: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.092909Z"},"links":{"cited_paper":"/paper/2402.05391","citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:1ec807f92b081128c68390b6ec320fbc46a9c22edcf00031327af27d84af0ef6","observation_id":"eb9c07ab-a7a1-412b-ab29-24a313af6f47","resolution":{"observed_at":"2026-08-16T12:06:52.092909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.596136Z","title":"Large language models and knowledge graphs: Opportunities and challenges,","venue":null,"work_id":"97b9e8d7-0d0c-4fa3-bab5-91055d3109c3","year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.098389Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:9a266981dc93c6df826baa7ebd3b83b404287da4972cc5fdc9920c785582aebc","observation_id":"69e2a0c8-cb21-499c-b17a-9d252350b4f0","resolution":{"observed_at":"2026-08-16T12:06:52.601331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.583440Z","title":"Unsupervised semantic correspondence using stable diffusion,","venue":null,"work_id":"9b8bbeee-a6f9-482d-b243-efe22fbff119","year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.103303Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:8869831ab18ec32408c01dd3edc534aaaf7e41e4de6429ab4141abec4b7cdd65","observation_id":"3578ca60-670e-47f7-b163-50a80e77a307","resolution":{"observed_at":"2026-08-16T12:06:52.587702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.107640Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.107640Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:18ea8a3cca8add57f8e6d81995208ec0f944031919ecb978fa0f3ccdf34e6d87","observation_id":"9fd3671d-7223-4f9c-bb69-eb0271dfe4ef","resolution":{"observed_at":"2026-08-16T12:06:52.107640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.561969Z","title":"Draw me like my triples: Leverag- ing generative AI for wikidata image completion,","venue":null,"work_id":"a953935c-44f2-4385-a1ed-689bdbef19b2","year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.113815Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:d3fa776ee18dde52e49115043af490d86e376a8c4c74f7982ca0c5b2af0d228d","observation_id":"48b55222-78b1-49b6-b100-5dc6390f27b6","resolution":{"observed_at":"2026-08-16T12:06:52.566311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.549181Z","title":"Oracle bone inscriptions infor- mation processing based on multi-modal knowledge graph,","venue":null,"work_id":"2197fc83-a8b7-4345-bcf7-50735fc83f08","year":2021},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.118496Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:af2c7860c4d77c00de0d35716dd73793364c569ddd53ca79ddd4f020a346066e","observation_id":"2db7d022-8a25-4303-8d15-8c63cfd45a51","resolution":{"observed_at":"2026-08-16T12:06:52.553477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.532077Z","title":"Imgpedia: A linked dataset with content-based analysis of wikimedia images,","venue":null,"work_id":"1f0c47b4-8458-4639-b0b3-dc61487d4a25","year":2017},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.123091Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:ef78d5546fc1911d6ccaad57cfa1b37f0a010312b303d15a860dbab8380c1f94","observation_id":"76e45c6a-df98-4d4a-92eb-def653148ff1","resolution":{"observed_at":"2026-08-16T12:06:52.536636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.517210Z","title":"GAIA: A fine-grained multimedia knowledge extraction system,","venue":null,"work_id":"4d50cba5-ad2f-4872-9ad5-bccb25e0feea","year":2020},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.128591Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:8f5f2222bc8ba708311e61e107c309b8937bb51ed488b4eb0cd531fc7b3fdd25","observation_id":"f44345b7-a40f-4c34-a828-3e3e58df6b94","resolution":{"observed_at":"2026-08-16T12:06:52.521996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.09150","last_updated":"2021-10-20T10:08:17Z","snapshot_observed_at":"2026-08-10T21:58:21.269522Z","submitted_at":"2020-08-20T18:20:29Z","title":"VisualSem: A High-quality Knowledge Graph for Vision and Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.09150","snapshot_observed_at":"2026-08-16T12:06:52.134081Z","title":"Visualsem: a high-quality knowledge graph for vision and language,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.134081Z"},"links":{"cited_paper":"/paper/2008.09150","citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:9dfa217598db895c4230d102b67331c82268a047d26ddcdd27ce018aa5faedb6","observation_id":"1920ed46-af5d-49a3-99bc-a3d4da9e2fa7","resolution":{"observed_at":"2026-08-16T12:06:52.134081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.139342Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.139342Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:eaa1ee6b6792876692597f40c5b2f29aeba73d1655c72bf7cbefd39506f12d06","observation_id":"4f4da245-c97f-46a7-ac56-6f5762a2b580","resolution":{"observed_at":"2026-08-16T12:06:52.139342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.495352Z","title":"Answering visual-relational queries in web- extracted knowledge graphs,","venue":null,"work_id":"d766506a-4858-4f67-a0e2-f769f5c0f8c4","year":2019},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.143523Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:124826238aac5b38eba9500ccae4445503e69848653cbb55f66cbec4e2cf6e6f","observation_id":"a59dce1d-835d-4365-a01a-58292538c3a7","resolution":{"observed_at":"2026-08-16T12:06:52.500088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.480827Z","title":"MMKG: multi-modal knowledge graphs,","venue":null,"work_id":"3e7e4460-05fb-4509-8fe1-f373c702c3b9","year":2019},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.147274Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:7dfadb23086c2a7a8614cd4c9cf4aae26935d43ec2a832482eecdab29f035b13","observation_id":"084c65ad-196e-4aaa-b370-934d4c16071f","resolution":{"observed_at":"2026-08-16T12:06:52.484878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.465233Z","title":"TIV A-KG: A multimodal knowledge graph with text, image, video and audio,","venue":null,"work_id":"787a8151-fe1a-42eb-903f-6aa7ac54b2f4","year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.151987Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:b768b9c3efa6b78d69de65ab65709616c0f91dc41195faacaa442c85217f6356","observation_id":"9580cc15-e4e0-4d40-9939-0ae01527cc39","resolution":{"observed_at":"2026-08-16T12:06:52.469856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.450060Z","title":"Mmpedia: A large-scale multi-modal knowledge graph,","venue":null,"work_id":"38c5405e-a18c-472a-a920-b5631103e455","year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.156792Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:2142d2a1bfbc50e9712d350928b550a8b53574038324411827e3e0631dd47906","observation_id":"c83d8c0a-7283-44fc-bee1-b1b022397ad9","resolution":{"observed_at":"2026-08-16T12:06:52.454918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.435205Z","title":"Richpedia: A large-scale, comprehensive multi-modal knowledge graph,","venue":null,"work_id":"e9322443-e95c-446f-9207-7ba3ecbff2cb","year":2020},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.160736Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:495602b906cf32dac313baa46ad3ac043f5d9076bba75855610fbc873eba8006","observation_id":"04c89251-d153-4e4c-a106-e931e74d522f","resolution":{"observed_at":"2026-08-16T12:06:52.439555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.419427Z","title":"Aspectmmkg: A multi- modal knowledge graph with aspect-aware entities,","venue":null,"work_id":"ed0b7997-3fa1-41eb-8269-a6465e9b783e","year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.164726Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:3f10d36733ba02559ae4ae338065c5e6e52b550ae31f2cf6940f687309359633","observation_id":"d5904fe0-b143-4f98-8921-56404b797f21","resolution":{"observed_at":"2026-08-16T12:06:52.424894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-16T12:06:52.168333Z","title":"Hierar- chical text-conditional image generation with CLIP latents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.168333Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:7989a0e7480efa6ff08227949cbcc21d15095e1262d0f1609b6941f843d6cb61","observation_id":"53931216-b76f-424c-833b-3dc02b8fa021","resolution":{"observed_at":"2026-08-16T12:06:52.168333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14670","last_updated":"2024-03-23T10:10:18Z","snapshot_observed_at":"2026-08-16T15:37:03.530656Z","submitted_at":"2023-04-28T08:03:42Z","title":"Prompt Engineering for Healthcare: Methodologies and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14670","snapshot_observed_at":"2026-08-16T12:06:52.173770Z","title":"Prompt engineering for healthcare: Methodologies and applications,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.173770Z"},"links":{"cited_paper":"/paper/2304.14670","citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:ec21d3e76dce65b650d5d83a30c0f3b8f1a45a5cf4d4ca266c3f085afe42ad31","observation_id":"b11c752b-227a-4150-8e11-aa5b3b2366a8","resolution":{"observed_at":"2026-08-16T12:06:52.173770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.400571Z","title":"Imagereward: Learning and evaluating human preferences for text-to- image generation,","venue":null,"work_id":"689373f4-920c-4036-acab-c2e574c696f4","year":2023},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.178611Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:e8f219b304922da301011d3d4a529a24bf15faf83cb38d5f1b5217fa1bc0cb97","observation_id":"a8fa0efd-77c8-4698-b9d3-1dac777f9662","resolution":{"observed_at":"2026-08-16T12:06:52.407647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.388713Z","title":"Composition- based multi-relational graph convolutional networks,","venue":null,"work_id":"cf07795d-ed90-4c29-9f0c-7e18126d9964","year":2020},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.183292Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:6194cd289f272aa1cdf87e5dd1c47532f4a739167eb2e01efa72e0d7eb6cfbcf","observation_id":"78f04f1f-8be4-4632-9a0a-29e53b0d64aa","resolution":{"observed_at":"2026-08-16T12:06:52.392670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.376542Z","title":"Wikidata: a free collaborative knowl- edgebase,","venue":null,"work_id":"8a08ff45-a99a-4ab6-9a5f-da6af33d3f97","year":2014},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.188391Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:04d462f3d5b108082cbb9db184a3d9647c5530f51fe3c090d5f1a862dff92060","observation_id":"5dc0383c-15ec-4028-8a2e-e48c19a81526","resolution":{"observed_at":"2026-08-16T12:06:52.380808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.363333Z","title":"Dbpedia - A large-scale, multilingual knowledge base extracted from wikipedia,","venue":null,"work_id":"767f1e4f-3b1c-4751-990b-8d69db5e01ed","year":2015},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.192322Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:a527da44a60b2a25a9c6108abe65a4ebef1c5d25378853d15ac39623e3530a07","observation_id":"5908e89e-e501-4260-8b30-e9f27fce1243","resolution":{"observed_at":"2026-08-16T12:06:52.367332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.349921Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":"ae8bee1b-5158-4344-9923-edd66b35da8a","year":2017},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.196497Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:f365b25d7b3323b10dda425a27400a923a2b79c8ffb7460bfc37b2e741fb8372","observation_id":"a485c49c-fae3-43d1-baca-6bf97454f089","resolution":{"observed_at":"2026-08-16T12:06:52.354355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.337237Z","title":"Clipscore: A reference-free evaluation metric for image captioning,","venue":null,"work_id":"0ebf24d8-ec0f-4db8-80e3-21552317f7c8","year":2021},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.200343Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:1f44a1a58d82e7c882aab2bfcf5a8844e0aa20a2ff2ca3aab2a861dc9cb5a32b","observation_id":"777ea20c-9e18-4409-ae8b-be4043c87900","resolution":{"observed_at":"2026-08-16T12:06:52.341623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.323369Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":"7aa79a42-4785-417f-9553-a219935a8f35","year":null},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.203985Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:1178e9185532430ee87f25a3deaa235c4f3bdaea81c48e89f65e7f9fe6e7be60","observation_id":"34d206b2-27aa-41e7-b743-d398e2b344a6","resolution":{"observed_at":"2026-08-16T12:06:52.327929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.294625Z","title":"Native: Multi-modal knowledge graph completion in the wild,","venue":null,"work_id":"8a936a0e-02e2-49c4-849d-1c58bcae2473","year":2024},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.211786Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:024cf190479485f1846a456b3571ff16ca71ce8cdb44874fce1a7127c0f36983","observation_id":"f33f137b-a376-4bf2-af71-cf8a5050e8f3","resolution":{"observed_at":"2026-08-16T12:06:52.300644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:52.310211Z","title":"8748–8763","venue":null,"work_id":"a962695f-4887-4a03-b749-87ddfd338779","year":2021},"citing_paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts","version":1},"reference_index":139,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:52.208128Z"},"links":{"citing_paper":"/paper/2504.13631"},"observation_digest":"sha256:d4b93a1255505a323863efa37cd5b5ccff8898b4f3421f1bc481dc095fba9421","observation_id":"d8c42ac9-9c94-4622-b15b-cdae7f67ad0c","resolution":{"observed_at":"2026-08-16T12:06:52.313990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.13631","last_updated":"2025-04-18T11:12:49Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-19T02:19:07.976648Z","submitted_at":"2025-04-18T11:12:49Z","title":"Multi-modal Knowledge Graph Generation with Semantics-enriched Prompts"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2504.13631."}