{"as_of":"2026-08-12T06:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a66751152c88a9b63a93cf8da311f6875b0e3e2121eded1d8458db88f9fc4ad6","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:28:40.387700Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19886/citation-record","integrity":"/paper/2607.19886/integrity","json":"/paper/2607.19886/citation-record.json","paper":"/paper/2607.19886"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.071770Z","title":"Sensors21(10), 3465 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.071770Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:6fc78330bbc81e44e96cdd188b1d6d2880a591ba3d3b7a57bdc2e2c6f98211a8","observation_id":"523e043e-4ebf-45bb-a058-0f563d46741b","resolution":{"observed_at":"2026-08-01T11:28:37.071770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.205366Z","title":"In: 16 Z","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.205366Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:ac4d8e85d63d2df9c9ac31ab8622266212c7b1c14e637fe5fcd6400e0d77c094","observation_id":"3e003415-33c2-4d65-82ce-3b2c39a09b9f","resolution":{"observed_at":"2026-08-01T11:28:37.205366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.320638Z","title":"Neurocomputing611, 128626 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.320638Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:d0165deaf78c3f2187e532ef6c72ca5e79c1b01c98d0ea609536ed255ae3840a","observation_id":"c07da58e-84b3-45ed-b673-5dfa178a6019","resolution":{"observed_at":"2026-08-01T11:28:37.320638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.04862","last_updated":"2017-01-17T20:46:21Z","snapshot_observed_at":"2026-08-08T05:04:33.029893Z","submitted_at":"2017-01-17T20:46:21Z","title":"Towards Principled Methods for Training Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.04862","snapshot_observed_at":"2026-08-01T11:28:37.374320Z","title":"arXiv preprint arXiv:1701.04862 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.374320Z"},"links":{"cited_paper":"/paper/1701.04862","citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:917dd34a89f2765e66bdca5b517c3c11351e1da2a792d0fd33a5f0a77989a7a5","observation_id":"be0c48f9-6b4d-4ae3-883f-e53ee8375ebd","resolution":{"observed_at":"2026-08-01T11:28:37.374320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.487893Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.487893Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:006d1ec1dfcfee2a4d8ac9bdc79d5384d409f61847a55b78aa2e1ae64a65ea01","observation_id":"846ba57e-bb95-452d-8cee-aabb8f232dee","resolution":{"observed_at":"2026-08-01T11:28:37.487893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.586045Z","title":"IEEE Transactions on Infor- mation Forensics and Security18, 133–146 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.586045Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:b3e77079024de876e00b60387cacf3649b6e5531b22de3c381f74b55a6f6b5df","observation_id":"61eaf951-73e3-418e-b895-28de6427b8b1","resolution":{"observed_at":"2026-08-01T11:28:37.586045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.713484Z","title":"Advances in neural information processing systems33, 6840–6851 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.713484Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:9ca836aabcb0fe01a31d84621cff0402c10393c92ea399269ff9498ca46e80b2","observation_id":"9e4a59ba-ef39-4177-ae77-e8cda9672e16","resolution":{"observed_at":"2026-08-01T11:28:37.713484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.869972Z","title":"In: 2021 IEEE Interna- tional Joint Conference on Biometrics (IJCB)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.869972Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:70647db1723dfd30332df2a5abff3360712dd450128994fd78eee7bd0420df08","observation_id":"ced33ea4-3f3f-4b2b-a893-7a3e8b0f11a5","resolution":{"observed_at":"2026-08-01T11:28:37.869972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:37.957907Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:37.957907Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:8911470dfd1eb9739eb2954c4cf073e47d279bebb6af4448fa5c75de929f039f","observation_id":"5389b4d1-c5a6-4c71-bb13-be3d8c4443d9","resolution":{"observed_at":"2026-08-01T11:28:37.957907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:38.066965Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern Recognition","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:38.066965Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:3a2f5a1bffd64c8c2c85437cc92fa02a2233eba98e9cd0f79c6abfa58d9194ba","observation_id":"7d67a1b7-3ba4-4998-bc61-46d519644653","resolution":{"observed_at":"2026-08-01T11:28:38.066965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:38.210330Z","title":"IEEE Signal Processing Letters (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:38.210330Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:25fcaf23e9b9bd5928e903f09ab995d5321ff4bd92d60e23b0abda7ca81c5013","observation_id":"bdd2d199-d3f8-496d-8f72-80a9511f69b4","resolution":{"observed_at":"2026-08-01T11:28:38.210330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:38.348736Z","title":"In: Proceedings of the 32nd ACM International Confer- ence on Multimedia","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:38.348736Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:007e3e800c87919f6d9cfa0b0c705ca57a0d77ecd9da99e57fffe3862f7fef42","observation_id":"e2c02af0-3eee-4e64-93b3-90b726ba8fd4","resolution":{"observed_at":"2026-08-01T11:28:38.348736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:38.543694Z","title":"Advances in neural information processing systems36, 34892–34916 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:38.543694Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:6e86fed5673bdddf39340c3a60c4594fbba7756d758def873aefdf8693b01d87","observation_id":"f0f86963-8997-4c43-b6e9-bc1aafc1fa64","resolution":{"observed_at":"2026-08-01T11:28:38.543694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:38.653051Z","title":"In: Proceedings of the 32nd ACM International Conference on Multimedia","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:38.653051Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:b917d8dc38c8a5d113a0c9b241baddf678257bd8f524c596bd8e321c8b1a2c03","observation_id":"10b45851-1821-4788-96c5-46511bd76e62","resolution":{"observed_at":"2026-08-01T11:28:38.653051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:38.739729Z","title":"In: Proceedings of the AAAI conference on artificial intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:38.739729Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:fad1614ef1279c1d6acedacb2a58c390aa68d204c4e3ad447bbdfd242db98ee2","observation_id":"ea8eecdf-cbdf-4d07-b098-a5ef4576cdc4","resolution":{"observed_at":"2026-08-01T11:28:38.739729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:38.900569Z","title":"In: 2023 IEEE 17th International Conference on Automatic Face and Gesture Recognition (FG)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:38.900569Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:1deeef4b93281acad4359ac20eb4f0439857390bb2cc10045ce36ab4a98f9b73","observation_id":"3be708e5-3be5-4339-b626-3d983228363f","resolution":{"observed_at":"2026-08-01T11:28:38.900569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.039882Z","title":"In: ACM SIGGRAPH 2023 conference proceedings","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.039882Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:8b867f9e95f45ff0dadf10829c8ad9e718e74398e84b8f3ff5457f78c4c0989c","observation_id":"487ade04-9acb-4f2e-a1dc-adb432ea3797","resolution":{"observed_at":"2026-08-01T11:28:39.039882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19012","last_updated":"2025-03-24T17:58:09Z","snapshot_observed_at":"2026-08-07T16:40:27.010988Z","submitted_at":"2025-03-24T17:58:09Z","title":"DiffV2IR: Visible-to-Infrared Diffusion Model via Vision-Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19012","snapshot_observed_at":"2026-08-01T11:28:39.116403Z","title":"arXiv preprint arXiv:2503.19012 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.116403Z"},"links":{"cited_paper":"/paper/2503.19012","citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:ac5448b4f1cc107551fafb30646c3f354adec6671034c848262fda5b72654baf","observation_id":"4a74ba66-e586-44d9-9343-4aaa66e53ae6","resolution":{"observed_at":"2026-08-01T11:28:39.116403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.236086Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.236086Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:264f36fbb6d5222693b0615ad3996b12922681afdff4eab072ff9d6c1444803f","observation_id":"7c94ec0d-d1d7-45a9-bf13-f1c987e817bc","resolution":{"observed_at":"2026-08-01T11:28:39.236086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.319015Z","title":"arXiv preprint arXiv:2510.22994 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.319015Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:5d9d0c6d24dbb38408d196547e256ce8590dfec0bc2ca97a70395263de029a0c","observation_id":"1a75b488-7ca7-4d8f-8950-4c0ce3eb7991","resolution":{"observed_at":"2026-08-01T11:28:39.319015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.438952Z","title":"Advances in neural information processing systems30(2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.438952Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:961cf642a4596c272552b6f5d966dcc03aac816224b30816c90b344d77f9e214","observation_id":"df647516-d1af-4b5a-9605-680daa9798f9","resolution":{"observed_at":"2026-08-01T11:28:39.438952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.559307Z","title":"International Journal of Computer Vision 132(12), 5929–5949 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.559307Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:5311cb741a3d650056fa81dd98b037fb36abb7831e1807e04610f39f10dae7e4","observation_id":"5574471c-4c99-4766-8e41-a06e339c665e","resolution":{"observed_at":"2026-08-01T11:28:39.559307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15488","last_updated":"2024-10-20T15:41:42Z","snapshot_observed_at":"2026-08-11T18:23:46.057153Z","submitted_at":"2024-07-22T09:05:16Z","title":"DiffX: Guide Your Layout to Cross-Modal Generative Modeling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15488","snapshot_observed_at":"2026-08-01T11:28:39.617445Z","title":"arXiv preprint arXiv:2407.15488 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.617445Z"},"links":{"cited_paper":"/paper/2407.15488","citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:73f54d930d6a3e8821da3cb27152107756d6681da52d6e05c1521c88294e448c","observation_id":"9f57f89c-99a2-462a-aa0b-e53d5c7936c4","resolution":{"observed_at":"2026-08-01T11:28:39.617445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.760787Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.760787Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:909bb642569d6988dfd8983006b1cdbbc8ff4f8d8f788831a2452bbbadf7af0f","observation_id":"c43df3a4-7e9f-4080-be45-f0a601fffc21","resolution":{"observed_at":"2026-08-01T11:28:39.760787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.871244Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.871244Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:786fcc48eb0558fa8163d93664dcd903d2f1be61197a4bcf6e71eee85d6c0c78","observation_id":"c55ed01f-baf9-4cb7-9842-aa13586b8083","resolution":{"observed_at":"2026-08-01T11:28:39.871244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.957952Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.957952Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:b1f868f0f3d0d473dabef0fa0eabbc0bcc42c14f6ee643afaa8b6f423d485b8c","observation_id":"2188c18a-fbe3-4ac1-a33d-643ab29acce3","resolution":{"observed_at":"2026-08-01T11:28:39.957952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:39.992362Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:39.992362Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:8685db3d589004c5838002d40d1ebb0f6377ccd148d6130c6dfdd21beecb5412","observation_id":"0a0dcc13-9afd-48e7-b4b8-a29f03ce4fa6","resolution":{"observed_at":"2026-08-01T11:28:39.992362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:40.146885Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:40.146885Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:6faca4c936517dcd1ebf1299cc2b6e5d9d1ae4718e83857741c42cb0e8f98b3b","observation_id":"96dfbe0d-aafa-4fdd-ba6e-4e8b951ee900","resolution":{"observed_at":"2026-08-01T11:28:40.146885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:40.279309Z","title":"arXiv preprint arXiv:2512.23519 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:40.279309Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:4809394775b7a437752baaa387a49bec5c944dd0242bafc9d6108f154c0cea8d","observation_id":"f61b769e-0289-468f-9077-325a7c5f7355","resolution":{"observed_at":"2026-08-01T11:28:40.279309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:28:40.387700Z","title":"In: Proceedings of the IEEE interna- tional conference on computer vision","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T11:28:40.387700Z"},"links":{"citing_paper":"/paper/2607.19886"},"observation_digest":"sha256:00e14bfd9ff5a3ba85e8976e569bf74b3aaa2205ff9659d50e84c519f4e68786","observation_id":"69960249-917e-4fd9-8d0b-052a0bb1dedf","resolution":{"observed_at":"2026-08-01T11:28:40.387700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19886","last_updated":"2026-07-22T08:16:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T20:04:18.463684Z","submitted_at":"2026-07-22T08:16:51Z","title":"MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2607.19886."}