{"as_of":"2026-08-18T04:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9951df969d569978cf82b7656997d4efdf82d5d88d8bd88219d0972364b8b74","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:35:59.141011Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.06814/citation-record","integrity":"/paper/2505.06814/integrity","json":"/paper/2505.06814/citation-record.json","paper":"/paper/2505.06814"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.754587Z","title":"Overview of the nlpcc 2023 shared task: Chinese medical instructional video question answering","venue":null,"work_id":"b8d555a3-588e-4422-a6c0-f35141a944a7","year":2023},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.022150Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:96fcc0e31f5dbde277e2c1a8e9e96386e6811cd10f06bffe64ea671ef331682f","observation_id":"1c57d5a9-210a-4431-afbf-c0a191e80ee0","resolution":{"observed_at":"2026-08-15T22:35:59.758298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.743218Z","title":"Overview of the nlpcc 2024 shared task 7: Multi-lingual medical instructional video question answering","venue":null,"work_id":"1bf5f888-205e-4abe-8f55-f2b16aeecf51","year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.026946Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:165f9901f431fabc9a1f390c939d798efcfcd3911e977e994850a4bb6842c314","observation_id":"758a6f30-b67a-4025-be8d-c552ed6d11e5","resolution":{"observed_at":"2026-08-15T22:35:59.747241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.731664Z","title":"A systematic review of machine learning applications in infectious disease prediction, diagnosis, and outbreak fore- casting","venue":null,"work_id":"a7594984-c341-4da9-bf46-3f2d2734334f","year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.030812Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:dbae5d33e3865169ac13b4b397447e3f1db10f06502e9bf804fee332553eeae6","observation_id":"1ec040bd-3dfe-41fb-81fa-41ad91841e34","resolution":{"observed_at":"2026-08-15T22:35:59.735619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.720970Z","title":"Tf-icon: Diffusion-based training-free cross-domain image composition","venue":null,"work_id":"4246321c-82f0-4b39-9e2b-af5c80f1b21d","year":2023},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.034940Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:f0cd96b36290649bfafb442c2dd932f0054daafb686102ee6e971b1b303d4f01","observation_id":"0a546ac8-8eee-48a1-8fff-9b5cd3417b1b","resolution":{"observed_at":"2026-08-15T22:35:59.724868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.708268Z","title":"Ich-prnet: a cross-modal intracerebral haemorrhage prognostic prediction method using joint-attention in- teraction mechanism.Neural Networks, 184:107096, 2025","venue":null,"work_id":"9ebfb493-fc24-4aab-a693-f327a2308e67","year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.038753Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:0098ba65077dfc5320688591f524a907976f86fdef61d6f38e8c893cb263aa40","observation_id":"95db3e03-0c2f-4493-8de1-2aab886ad0c7","resolution":{"observed_at":"2026-08-15T22:35:59.713670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.695690Z","title":"Ich-scnet: Intracerebral hemorrhage segmentation and prognosis classification network using clip-guided sam mecha- nism","venue":null,"work_id":"d1fd71ba-3dd5-48b6-9847-5794e2569329","year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.042707Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:fd98b4ed26f225e8ae00fffd78cbc7e712099201c5f8d3dc5d6de7f141fde762","observation_id":"966b5fce-d1e8-48f7-94c8-36a309855057","resolution":{"observed_at":"2026-08-15T22:35:59.699572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20733","last_updated":"2024-12-30T06:14:48Z","snapshot_observed_at":"2026-08-16T01:11:58.838268Z","submitted_at":"2024-12-30T06:14:48Z","title":"Towards nation-wide analytical healthcare infrastructures: A privacy-preserving augmented knee rehabilitation case study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20733","snapshot_observed_at":"2026-08-15T22:35:59.046732Z","title":"Towards nation- wide analytical healthcare infrastructures: A privacy-preserving augmented knee rehabilitation case study.arXiv preprint arXiv:2412.20733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.046732Z"},"links":{"cited_paper":"/paper/2412.20733","citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:3a38e2fa4bb54919158ce5fb27380d38e5ee94ef27099a04eb4eff54339e74e8","observation_id":"529b38af-485b-449e-8eb8-df14adbd592d","resolution":{"observed_at":"2026-08-15T22:35:59.046732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02851","last_updated":"2024-11-05T06:49:14Z","snapshot_observed_at":"2026-08-17T22:55:49.432465Z","submitted_at":"2024-11-05T06:49:14Z","title":"Learning to Unify Audio, Visual and Text for Audio-Enhanced Multilingual Visual Answer Localization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02851","snapshot_observed_at":"2026-08-15T22:35:59.050670Z","title":"Learning to unify audio, visual and text for audio-enhanced multilingual visual answer localization.arXiv preprint arXiv:2411.02851, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.050670Z"},"links":{"cited_paper":"/paper/2411.02851","citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:74d801c989bdb943b86440ede2503a24b8fdccc8d6ecff3e8d449fea0b6cea68","observation_id":"7479754d-4183-4d75-8184-07cae77cb536","resolution":{"observed_at":"2026-08-15T22:35:59.050670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.684348Z","title":"Prism: Self-pruning intrinsic selection method for training-free multi- modal data selection, 2025","venue":null,"work_id":"27657b92-2817-405d-a46b-1cd1b0aa9c97","year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.054396Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:645a266308868180081d5169d1c346999e551f3f03b1ee7c74a63caeff16442d","observation_id":"1391dcac-a8f6-49ae-8eea-57d2cdf5a872","resolution":{"observed_at":"2026-08-15T22:35:59.688250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18775","last_updated":"2025-03-15T02:23:29Z","snapshot_observed_at":"2026-08-16T13:06:15.865567Z","submitted_at":"2024-10-24T14:28:32Z","title":"Robust Watermarking Using Generative Priors Against Image Editing: From Benchmarking to Advances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18775","snapshot_observed_at":"2026-08-15T22:35:59.057796Z","title":"Robust watermarking using generative priors against image editing: From benchmarking to advances.arXiv preprint arXiv:2410.18775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.057796Z"},"links":{"cited_paper":"/paper/2410.18775","citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:a1478c1a20ca1136744d10594b144f2e14431dfa662c5b61810527d5c23a3e07","observation_id":"e3abe435-08eb-4872-b31f-5df9a368e361","resolution":{"observed_at":"2026-08-15T22:35:59.057796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12782","last_updated":"2025-04-17T09:29:30Z","snapshot_observed_at":"2026-08-17T20:20:01.027194Z","submitted_at":"2025-04-17T09:29:30Z","title":"Set You Straight: Auto-Steering Denoising Trajectories to Sidestep Unwanted Concepts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12782","snapshot_observed_at":"2026-08-15T22:35:59.061770Z","title":"Set you straight: Auto-steering denoising trajectories to sidestep unwanted concepts.arXiv preprint arXiv:2504.12782, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.061770Z"},"links":{"cited_paper":"/paper/2504.12782","citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:5403f60ea82039d17f21705604190159db043a06f55a337773123a3e85b61f1f","observation_id":"d6dd0299-1b94-4dc0-8017-ff7b32d66fd3","resolution":{"observed_at":"2026-08-15T22:35:59.061770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.09220","last_updated":"2022-04-20T04:41:26Z","snapshot_observed_at":"2026-08-16T17:05:55.571348Z","submitted_at":"2022-04-20T04:41:26Z","title":"LingYi: Medical Conversational Question Answering System based on Multi-modal Knowledge Graphs","version":1},"cited_work":{"arxiv_id":"2204.09220","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.09220","snapshot_observed_at":"2026-08-15T22:35:59.440985Z","title":"LingYi: Medical Conversational Question Answering System based on Multi-modal Knowledge Graphs","venue":"cs.CL","work_id":"aa49cf24-158e-4754-a979-e98304801952","year":2022},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.066362Z"},"links":{"cited_paper":"/paper/2204.09220","citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:f7b558638ef546ae431b1c20607d8f65c2a1eb05208a38bb7c42b94da31de893","observation_id":"fd829d8b-1740-4d6b-abbe-bace547192c5","resolution":{"observed_at":"2026-08-15T22:35:59.447503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.671491Z","title":"Llava steering: Visual instruction tuning with 500x fewer parameters through modality linear representation-steering, 2025","venue":null,"work_id":"e07135a2-95d4-43af-9d34-ba873685bf8b","year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.070339Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:97036f4d7809decf320346c6afd58c0fa10aeb2de9374272f8e04a3c0a4a9eb4","observation_id":"dfd89b6e-3d66-49a3-8568-501979759302","resolution":{"observed_at":"2026-08-15T22:35:59.676218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.659208Z","title":"Visual answer localization with cross-modal mutual knowledge transfer","venue":null,"work_id":"fb1dec6f-81c0-4885-bff2-9a7e67c2ccdf","year":2023},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.073882Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:d3aa96566db4cf2e274d0d2592fe8cb7dea982b598c062e18f842f5cf6eb02a5","observation_id":"de4d2db6-26ba-49f5-a727-64c64760e57b","resolution":{"observed_at":"2026-08-15T22:35:59.663265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.646812Z","title":"Enhancing thyroid disease prediction using ma- chine learning: A comparative study of ensemble models and class balancing tech- niques","venue":null,"work_id":"bb151df6-68f9-40ca-81f4-792908dfa983","year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.077678Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:38382a6d9c47b3c7f2506aa8fa23542bf11ef96aca506294d0c226c11ac1d38d","observation_id":"76ecb771-b6a3-4096-9fe8-2b86cdc612c4","resolution":{"observed_at":"2026-08-15T22:35:59.650841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.634073Z","title":"A generative adversarial network-based investor sentiment in- dicator: Superior predictability for the stock market.Mathematics, 13(9):1476, 2025","venue":null,"work_id":"1927000e-34b6-498f-ad4b-a5faaaa56ced","year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.081388Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:1079ce9840a5367dfe64e522edbfafcf71ada4e5d9b7ab147493c78d26345311","observation_id":"e16aaf9b-4a09-4897-a875-e1fcc5435eb5","resolution":{"observed_at":"2026-08-15T22:35:59.638327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.621805Z","title":"Multimodal high- order relationship inference network for fashion compatibility modeling in internet of multimedia things.IEEE Internet of Things Journal, 11(1):353–365, 2024","venue":null,"work_id":"0757b471-7832-4c88-90a4-b9024168ddb1","year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.085164Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:49e93cbdb307f47ef3ff8f59cb40977f804cd3beae1a1d705f12543719773524","observation_id":"c8055437-5f2e-4fee-9844-4432911f1809","resolution":{"observed_at":"2026-08-15T22:35:59.626294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.088942Z","title":"De- tection of ai deepfake and fraud in online payments using gan-based models.arXiv preprint arXiv:2501.07033, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.088942Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:924ba7b7a52c65c33e2717af495ff292a5bb0341ebbc6c0f30d0ccbe728edce1","observation_id":"c811c3bf-269a-451c-9600-d48be8e12205","resolution":{"observed_at":"2026-08-15T22:35:59.088942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.092542Z","title":"Enhancing intent understanding for ambiguous prompts through human-machine co-adaptation.arXiv preprint arXiv:2501.15167, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.092542Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:daa5c61c5fcd11cbe15e690a93397c2593df036df433d3641028bb81ac8412c9","observation_id":"fa1f9d64-991a-4edc-a3cc-ec90b10a80b0","resolution":{"observed_at":"2026-08-15T22:35:59.092542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.610349Z","title":"Mace: Mass concept erasure in diffusion models","venue":null,"work_id":"3ae3d5da-9c7c-498f-bd7c-e39186d7a5c4","year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.096530Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:20e043014bcc0bc3ebb69ecd6b051ae7d0153ea48fc213a41b00340860074820","observation_id":"e0228f52-1048-4cd5-8f3b-f16524a5ec4e","resolution":{"observed_at":"2026-08-15T22:35:59.614545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.100140Z","title":"Score: Story coherence and retrieval enhancement for ai narratives.arXiv preprint arXiv:2503.23512, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.100140Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:86785ca821f5274193fe7bff34ef52ea08e3fb30418274f5996fcd11fa290f79","observation_id":"bebc369c-b979-4d3a-ba0e-d7bd624b5273","resolution":{"observed_at":"2026-08-15T22:35:59.100140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.598364Z","title":"Learning to locate visual answer in video corpus using question","venue":null,"work_id":"340e0f40-2c0e-4068-a460-d4dfb2afa4fe","year":2023},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.103699Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:a5a1606b6d08e434a9d23d6719fa3c1bc6b419154ad79f6dfed15a368af22519","observation_id":"fc1cfef9-cc4d-4a33-8afd-ea729d6d5e98","resolution":{"observed_at":"2026-08-15T22:35:59.602358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.586633Z","title":"Improving multilingual temporal answering grounding in single video via llm-based translation and ocr enhancement","venue":null,"work_id":"e07eb283-3feb-4a41-aa72-a6c23ccb57e0","year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.107376Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:fba9f915039af7b5d56359dd2f6e4b2abea9283bbf2876cc8bcc40dfe5d832bc","observation_id":"7293766e-9a1c-4814-8131-12dc5b30f0ce","resolution":{"observed_at":"2026-08-15T22:35:59.590814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.573495Z","title":"Improv- ing cross-modal visual answer localization in chinese medical instructional video using language prompts","venue":null,"work_id":"3988fcad-299f-4f16-bf18-6adb865ec10f","year":2023},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.111232Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:aeb554854ee16ae90747b2879c474506e3b378323a9788f546489d751905362a","observation_id":"43e49dc4-b3b9-47b6-b4d7-ab929f706fd0","resolution":{"observed_at":"2026-08-15T22:35:59.577486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.114991Z","title":"Mqua: Multi-level query-video augmentation for multilingual video corpus retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.114991Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:d3af855972900bc1b5e48120aab50994e9a6c47d8d4321b4103fddfd591054ba","observation_id":"c0fa08cd-de37-4a06-878c-37d0b2f5ba7f","resolution":{"observed_at":"2026-08-15T22:35:59.114991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.118451Z","title":"A two-stage chinese medical video retrieval framework with llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.118451Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:376463c532e8c86ddda00078320227b6686dfb75843a958ad6d27d83202735d0","observation_id":"883cf69e-05ae-46b5-87a7-4fbd6afe1f1a","resolution":{"observed_at":"2026-08-15T22:35:59.118451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.121971Z","title":"Mul- tilingual temporal answer grounding in video corpus with enhanced visual-textual integration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.121971Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:06f08f16af1b76d4fc3656580d33fc54a8e24c9add7b46a8753bd7cee26c5e1f","observation_id":"e9606ac6-6f53-4326-8a77-c80581d56911","resolution":{"observed_at":"2026-08-15T22:35:59.121971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.125926Z","title":"A uni- fied framework for optimizing video corpus retrieval and temporal answer ground- ing: fine-grained modality alignment and local-global optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.125926Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:0cf358659eb54e02ffebd4a482c5874918db20e4c659e73ca9f36e055904a841","observation_id":"bb847df7-720d-48d3-a765-bc12eac5f669","resolution":{"observed_at":"2026-08-15T22:35:59.125926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.531534Z","title":"Correlation-aware cross-modal attention net- work for fashion compatibility modeling in ugc systems.ACM Transactions on Multimedia Computing, Communications and Applications, 2024","venue":null,"work_id":"5f64d31a-f572-4d0f-800c-e70933837658","year":2024},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.129694Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:c8e86c74302a142cf3b1d6e6c5c28d14099b17c2457bb51cabedf0df7c05e814","observation_id":"accf6a10-c5ee-4d6a-83d1-11f3fb446d26","resolution":{"observed_at":"2026-08-15T22:35:59.535640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.01852","last_updated":"2022-03-08T05:10:16Z","snapshot_observed_at":"2026-08-12T20:27:56.104756Z","submitted_at":"2020-07-03T17:58:42Z","title":"Language-agnostic BERT Sentence Embedding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.01852","snapshot_observed_at":"2026-08-15T22:35:59.133119Z","title":"Language-agnostic bert sentence embedding.arXiv preprint arXiv:2007.01852, 2020","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.133119Z"},"links":{"cited_paper":"/paper/2007.01852","citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:3c01bb5a4647f9224edd12a9b2a9682801b46a52a9c8512671deaf7232a67ac2","observation_id":"d20edbe7-de37-424a-9a99-ef5de3e73c9e","resolution":{"observed_at":"2026-08-15T22:35:59.133119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.520200Z","title":"Vpai lab at medvidqa 2022: a two-stage cross-modal fusion method for medical instructional video classi- fication","venue":null,"work_id":"c5dcfdb7-68d2-461a-9f97-ef4e27351208","year":2022},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.137319Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:d9a39f47a4db52dc39ea7335a3d40e12f4decbf82e586c82e68da976bd421200","observation_id":"fcea76bc-44ba-48eb-8632-e924b1305c27","resolution":{"observed_at":"2026-08-15T22:35:59.524131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.508309Z","title":"Category-aware multimodal attention network for fashion compatibility modeling.IEEE Transac- tions on Multimedia, 25:9120–9131, 2023","venue":null,"work_id":"545acaa4-d957-4728-a3e3-5e1f04827ab1","year":2023},"citing_paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.141011Z"},"links":{"citing_paper":"/paper/2505.06814"},"observation_digest":"sha256:3faeafaa350e71622498bc1a2189260c6c6836c509501fd7af1c5e217761233a","observation_id":"f198ac09-494c-44a9-926b-43bef7043ebf","resolution":{"observed_at":"2026-08-15T22:35:59.512412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.06814","last_updated":"2025-05-11T02:15:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T20:32:10.693612Z","submitted_at":"2025-05-11T02:15:14Z","title":"Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":19},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2505.06814."}