{"as_of":"2026-08-08T00:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e6717efaadf01e73927bd91eefd37d0f563e334305dff862e6df35a4f4dab71e","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:28:53.114332Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02439/citation-record","integrity":"/paper/2506.02439/integrity","json":"/paper/2506.02439/citation-record.json","paper":"/paper/2506.02439"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:05.800277Z","title":"Appearance- preserving 3d convolution for video-based person re-identification,","venue":null,"work_id":"02ae52c0-3297-4a29-b5f8-e01c76146f57","year":2020},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:45.972486Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:8997cf5516bbd665fd3d62ec07809a9300d20d1016fd17c2dcb8bb771a9aca8c","observation_id":"c78dd35e-54c0-470c-b4d8-b42d85f39279","resolution":{"observed_at":"2026-08-07T11:29:05.839553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:05.635079Z","title":"Watching you: Global- guided reciprocal learning for video-based person re-identification,","venue":null,"work_id":"4beb67de-cb39-426c-8973-557e5a95cd0d","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.039304Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:6b0a600619e79e24c40f0145d33e01501fe0e6427e63a0a10d9d85d005f7d1a7","observation_id":"5732488f-1202-4c57-aa32-5f1ea7dfd14a","resolution":{"observed_at":"2026-08-07T11:29:05.701571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:05.481083Z","title":"Pyramid spatial-temporal aggregation for video-based person re-identification,","venue":null,"work_id":"aa64c996-3c09-43ff-bb0d-2208f6175fc6","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.191556Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:627cb0a38555211c8c8666d99ff8fe41389998f44bb14ede8b42c652832917d5","observation_id":"a7fdc642-ca12-4b35-a5c5-622b55ae511d","resolution":{"observed_at":"2026-08-07T11:29:05.545817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:46.298106Z","title":"Salient-to-broad transition for video person re-identification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.298106Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:b4227059b547a3181e2f610244d503f2b4fa726ba34b5e4f411365178ff97d59","observation_id":"edbcd77c-cc9c-484d-bf24-bca3ca6357be","resolution":{"observed_at":"2026-08-07T11:28:46.298106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:05.317346Z","title":"Deeply coupled convolution– transformer with spatial–temporal complementary learning for video- based person re-identification,","venue":null,"work_id":"e820897b-a52d-4491-a7e5-09438390f967","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.397420Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:b0abb295f20e82b7231bb218122a2930f9742dbfd576b8be8a48d093eb1c7215","observation_id":"7cc4dbb9-6dae-4888-93f2-cc6646c4d356","resolution":{"observed_at":"2026-08-07T11:29:05.380038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:05.142460Z","title":"A video is worth three views: Trigeminal transformers for video-based person re- identification,","venue":null,"work_id":"696a01fc-ac18-4ddf-a132-203cc6f36e09","year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.488063Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:5e1908f517cdd04b0cd08f1cc6c759e346e2831b4efc7fc0081ff3432e679951","observation_id":"aee3a5bf-ec2e-4be6-a426-eea30c0d3cad","resolution":{"observed_at":"2026-08-07T11:29:05.216269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:04.993406Z","title":"Tf-clip: Learning text- free clip for video-based person re-identification,","venue":null,"work_id":"d58c43e8-cec9-4181-a522-28d2c0de1477","year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.586643Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:0a04e6e46ba31fb9f51406c17c942aba54329300fea5e1a5047525fe3a3af0b2","observation_id":"21446319-972a-47c2-85e4-82a2d49052ab","resolution":{"observed_at":"2026-08-07T11:29:05.065680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:04.841499Z","title":"Body part-level domain alignment for domain-adaptive person re-identification with transformer framework,","venue":null,"work_id":"b9c4053b-c3e6-400b-9501-1b538bd8f93d","year":2022},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.705920Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:1a340396e32e08b53e252412df7b4260eee2ac61ad7183a4c356381128bbb04e","observation_id":"f1ab9d74-1dc4-4350-a5e9-dce6d714540a","resolution":{"observed_at":"2026-08-07T11:29:04.911394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:04.621058Z","title":"Deep learning for person re-identification: A survey and outlook,","venue":null,"work_id":"5a77e08a-66c5-42c0-87ed-697021bd08b4","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.827431Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:a0038a23b45b506b37d97d183a416008599c10f076331ae83da6ee174736a884","observation_id":"7f8cc03d-5520-4441-9c27-12e037b2a52d","resolution":{"observed_at":"2026-08-07T11:29:04.758655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:04.390683Z","title":"Partial person re-identification,","venue":null,"work_id":"cfb9bc1e-a18c-49f4-8f4e-a31ceb3b1515","year":2015},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:46.943280Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e1b3fbd0a3324a6652012039e4326c2c2c701568dd96b6e4bbf050d4cc0cb6af","observation_id":"134a0ec2-119e-483b-85ff-d6e5917390df","resolution":{"observed_at":"2026-08-07T11:29:04.488784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:04.145475Z","title":"Harmonious attention network for person re-identification,","venue":null,"work_id":"2cb04c79-d627-4c83-a048-bdeb3178d654","year":2018},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.037909Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:2042804198b70f37906d4475b1ec4ccbb60e5aaf296189fcb227453b082465fd","observation_id":"26783d33-2776-47ef-a405-3adf982ed2dc","resolution":{"observed_at":"2026-08-07T11:29:04.287770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:47.131926Z","title":"A survey of open-world person re- identification,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.131926Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:85d9e6741867c8f31f577069fe96b5eb8140bd893477b0ad7d5976831b83d38a","observation_id":"9a974912-1093-4127-af82-4f099cd4b1b5","resolution":{"observed_at":"2026-08-07T11:28:47.131926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:03.896424Z","title":"Dynamic tri-level relation mining with attentive graph for visible infrared re-identification,","venue":null,"work_id":"d9850a11-d972-465e-a3a8-da1df7abaa6e","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.272878Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:ec82cedec1eed37f5726800035321c3058b33171748ca45129d2e99017ec3c89","observation_id":"c9c74564-452d-44de-adcb-19d868e593cf","resolution":{"observed_at":"2026-08-07T11:29:04.002801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:03.721054Z","title":"Dual consistency-constrained learning for unsupervised visible-infrared person re-identification,","venue":null,"work_id":"26301a90-5bb9-42c1-a8c0-bd9c64bd91dd","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.395961Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:b3a09c6c057355c4292623ad6e23de9db68ff4e72980dbf78ff1227c9e952f79","observation_id":"49f30fda-1241-4a6c-89b3-977a9c403783","resolution":{"observed_at":"2026-08-07T11:29:03.773157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:47.506852Z","title":"Securereid: Privacy- preserving anonymization for person re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.506852Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:9e7502d4878430a44afb9540dfc66baa22af4b7d69c3d71cccb7fd7285316229","observation_id":"2c55d864-eb5e-4da6-a748-183b466aad3f","resolution":{"observed_at":"2026-08-07T11:28:47.506852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:47.621310Z","title":"Performance measures and a data set for multi-target, multi-camera tracking,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.621310Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e1d1e7261b5d4d2c79d1af33482f842af261e1dbe34d699c7202b16fcc90f4ce","observation_id":"bf29c47e-8ff4-411e-a494-bc489dc1eb23","resolution":{"observed_at":"2026-08-07T11:28:47.621310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:03.441479Z","title":"Person transfer gan to bridge domain gap for person re-identification,","venue":null,"work_id":"5279d9e7-a1bd-45e9-ad23-3bfbfcafdce9","year":2018},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.739148Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:35895a5c2d675d19935fbb9b648be288986b99765be48fa5257764658df1db8c","observation_id":"52463cff-3d63-4771-b063-16a81043fafd","resolution":{"observed_at":"2026-08-07T11:29:03.564643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:03.188726Z","title":"Mars: A video benchmark for large-scale person re-identification,","venue":null,"work_id":"0541b503-62de-4552-b477-d44fedf27bec","year":2016},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.864733Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:a2d3a1c007832adfa050601020b0ab0c1cf30d2382129e2636edb74637987e09","observation_id":"2b343dd6-9f56-494d-b6b7-fdfb8719f15c","resolution":{"observed_at":"2026-08-07T11:29:03.283310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:02.993699Z","title":"Global-local temporal representations for video person re-identification,","venue":null,"work_id":"a7a688ab-8511-4ee1-ae3f-2fa6c3f0d873","year":2019},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:47.997017Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:8f2c7e40d34475922e26f196873a8ac2c7b4c60d23a22ce6b18aae4c24a671ec","observation_id":"75f26583-499c-45b4-949d-4e508c29b6b7","resolution":{"observed_at":"2026-08-07T11:29:03.080484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:02.820792Z","title":"Exploit the unknown gradually: One-shot video-based person re-identification by stepwise learning,","venue":null,"work_id":"b6ea5c47-523f-412b-84ad-d27aed2ee501","year":2018},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.113378Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:35a6a8d386d828b35806302a1f8a8befb6267115da13f503ff0df29de64e1016","observation_id":"3c335a95-f975-47f9-938c-7f482fe7745b","resolution":{"observed_at":"2026-08-07T11:29:02.912473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:02.580526Z","title":"Person re-identification by video ranking,","venue":null,"work_id":"3fb7bdef-ad4c-4f08-a206-38bc3739d6bf","year":2014},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.258565Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:8987ece404811781fb01db69c58d2a85b0ee51ed934bfaacd9eaff3a64680d70","observation_id":"91edbfa9-a9fb-4e4f-b588-2e95cffc6689","resolution":{"observed_at":"2026-08-07T11:29:02.694948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:02.334623Z","title":"Person re- identification by descriptive and discriminative classification,","venue":null,"work_id":"11042010-e02c-4988-a307-e3484d846090","year":2011},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.396724Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:289e2f867377de7326cb6b16c001f2969bd7edb7908b39406ae0dacf59d1718c","observation_id":"6c87afe0-4a14-4e19-a439-eb296d6003ed","resolution":{"observed_at":"2026-08-07T11:29:02.482987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:02.150409Z","title":"Learning modal-invariant and temporal-memory for video-based visible-infrared person re-identification,","venue":null,"work_id":"0bab5607-1130-4d0e-bb0f-45c005b6f5b7","year":2022},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.511348Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:afae839831260f7345e5473d6943d7947ef2046111fe5d67028fd66e04ed3b31","observation_id":"fc51d40e-7183-4882-91c1-b2a72cee57d8","resolution":{"observed_at":"2026-08-07T11:29:02.195690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03903","last_updated":"2023-08-11T09:15:27Z","snapshot_observed_at":"2026-07-06T15:51:39.407201Z","submitted_at":"2023-07-08T05:03:10Z","title":"Adversarial Self-Attack Defense and Spatial-Temporal Relation Mining for Visible-Infrared Video Person Re-Identification","version":3},"cited_work":{"arxiv_id":"2307.03903","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.03903","snapshot_observed_at":"2026-08-07T11:28:53.512655Z","title":"Adversarial Self-Attack Defense and Spatial-Temporal Relation Mining for Visible-Infrared Video Person Re-Identification","venue":"cs.CV","work_id":"39c8c253-a5fb-4cf6-bdd1-5dec24e1157b","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.632770Z"},"links":{"cited_paper":"/paper/2307.03903","citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:7e05fe271c96b5e75a10c7dba396232091965c3ef5616367c8594b34780fa5b1","observation_id":"7454dc0e-facd-4db1-abee-77894fc5542a","resolution":{"observed_at":"2026-08-07T11:28:53.570364Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:01.894691Z","title":"Video-based visible- infrared person re-identification via style disturbance defense and dual interaction,","venue":null,"work_id":"9c75fe0f-34f3-4f60-adc0-0f8ac26e13a6","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.767327Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:5a9609e538c028c1621c865d923edbfe9df058c5a4bd38721213c65a046d4bff","observation_id":"7828939b-6c8a-410c-826b-db48ec047266","resolution":{"observed_at":"2026-08-07T11:29:02.028872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:48.876389Z","title":"Video-based visible-infrared person re-identification with auxiliary samples,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.876389Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:8acec6c8a9ab81bbfe526943120d66ee672367e80647539fc0712ad477e355a1","observation_id":"898322d4-7e29-4385-b640-d6379b436522","resolution":{"observed_at":"2026-08-07T11:28:48.876389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:01.651718Z","title":"Intermediary-guided bidi- rectional spatial-temporal aggregation network for video-based visible- infrared person re-identification,","venue":null,"work_id":"224904d8-9ca1-41b6-a747-2870037ce07f","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:48.958176Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:552374ab7409d8ec47ad5e4b27efa108207447cc6c5bfe6469c09a617f329e56","observation_id":"6d6c1b35-f3c8-41f6-88e2-e7efd2f8f374","resolution":{"observed_at":"2026-08-07T11:29:01.781457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:01.404471Z","title":"Clip-reid: exploiting vision-language model for image re-identification without concrete text labels,","venue":null,"work_id":"ccddadc2-e454-4103-940d-935f0748a4a0","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.074960Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:933124fdfdaa7cdcddd4df0012c8b249f4432a94a2453196ace575f53d5c6563","observation_id":"1a2c7c9f-3f68-4aa9-b119-66436d86fca8","resolution":{"observed_at":"2026-08-07T11:29:01.519532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:01.201529Z","title":"Cross-modality spatial-temporal transformer for video- based visible-infrared person re-identification,","venue":null,"work_id":"addcad4a-6121-42ca-a551-041d81fc8d9b","year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.185027Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:27e51856e719838511b7cbb19275601305e4395c19adb62712f6443104f08039","observation_id":"623e7a1f-b69f-4ad9-bba7-83a79890fb61","resolution":{"observed_at":"2026-08-07T11:29:01.301345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:00.945753Z","title":"Prompt switch: Efficient clip adaptation for text-video retrieval,","venue":null,"work_id":"e34e73cf-802e-4756-934e-d5e1e9b6a7ce","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.309559Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:94025d52fb98d117a1a2f7dbc20ee9a270da7eec13a258d7e9b53f73469a9269","observation_id":"aa242c7a-e694-44d2-9b98-310ea7bc510b","resolution":{"observed_at":"2026-08-07T11:29:01.080869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:00.705561Z","title":"Idea: Inverted text with cooper- ative deformable aggregation for multi-modal object re-identification,","venue":null,"work_id":"0ae78322-f39e-4030-a9d9-4120d4918980","year":2025},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.422868Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:25c4af40693819e241eba4125ad7d172d16e4c927fc4ad9ef1d9f0d0de3912d7","observation_id":"db4f4fa9-dd09-4dd3-b6a2-142fec94a4af","resolution":{"observed_at":"2026-08-07T11:29:00.830703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:00.517299Z","title":"Decoupled feature-based mixture of experts for multi-modal object re-identification,","venue":null,"work_id":"fdcfa40d-2fca-4226-b747-fa69f2057875","year":2025},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.527136Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e3b441e977fe10003b6d8e3186888ad834ac26e5d871ff3e999a2c55b2c90507","observation_id":"94280427-4d06-4eb2-8a1e-afa2c1b51bf0","resolution":{"observed_at":"2026-08-07T11:29:00.603752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:00.275770Z","title":"Mam- bapro: Multi-modal object re-identification with mamba aggregation and synergistic prompt,","venue":null,"work_id":"6f2db4ca-ac5f-4e67-a012-9155e802a684","year":2025},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.651480Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:d40b050f3d02042002117b10a33c6bac17f9df2b1d4171d0f41a15780006fb10","observation_id":"8d6f8a69-20e7-4903-8834-86e5ef1b9273","resolution":{"observed_at":"2026-08-07T11:29:00.347542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:59.997800Z","title":"Logical relation inference and multiview information interaction for domain adaptation person re-identification,","venue":null,"work_id":"8480df39-e824-48f0-a2fc-cd476c52fdbd","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.736788Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:0b520f86e66318af591ae24ccd5110b4456466080fea2cabb1bc7239d6c79101","observation_id":"59729fa7-420f-4049-afb7-e2d45246fc9b","resolution":{"observed_at":"2026-08-07T11:29:00.148369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:59.854170Z","title":"Attribute-aligned domain- invariant feature learning for unsupervised domain adaptation person re-identification,","venue":null,"work_id":"2bdf15b4-bd70-428b-b627-0eb16bbb7989","year":2020},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.823961Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:98ad81c08b0c3d1536f55d4f344c5217fbcd7f83635b6e9b073eaad742df33aa","observation_id":"f9f08d96-c97f-48ee-95f5-05302e83d31d","resolution":{"observed_at":"2026-08-07T11:28:59.916507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:59.606718Z","title":"Hybrid contrastive learning for un- supervised person re-identification,","venue":null,"work_id":"b38a4f13-2063-4843-befc-167e857b8a9a","year":2022},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:49.954379Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:0847ae79f3f3f52696751cfb8c716b00b6da5e9de9f43197a453dcbcf3d969d8","observation_id":"ea2685fe-43a6-4cc7-8ea6-ae2b80a33e52","resolution":{"observed_at":"2026-08-07T11:28:59.737313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:59.471268Z","title":"Learn- ing to reduce dual-level discrepancy for infrared-visible person re- identification,","venue":null,"work_id":"54c82394-16e2-48de-be0b-eec0b74c5849","year":2019},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.060295Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:ff0c77cdf451558d3e979a331daa8880c00077a2697c10efed068027dfb2e0d6","observation_id":"57fd0d62-1102-49a4-801e-9a0c0f111a17","resolution":{"observed_at":"2026-08-07T11:28:59.531116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:59.164564Z","title":"Tri-modality consistency optimization with heterogeneous augmented images for visible-infrared person re- identification,","venue":null,"work_id":"e123e901-ca6c-472e-8e80-a49af7035017","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.157496Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:0bb4f7989edf3ef23d9dbf26d1729e00b52b9fb1a1219510e41b9efd8d2c222d","observation_id":"22e099e7-4d7e-4c99-a061-f4a662a403f0","resolution":{"observed_at":"2026-08-07T11:28:59.305938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:58.798046Z","title":"Infrared-visible cross-modal person re-identification with an x modality,","venue":null,"work_id":"446f6333-cd51-42e8-8654-216bbf5b643b","year":2020},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.237939Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:37b39e07fd26649554a83c98eb76450d82f822c8ae6771ed14cc7d8d2661b043","observation_id":"635f5658-6d26-4bd4-a7fa-d006cadfcb13","resolution":{"observed_at":"2026-08-07T11:28:58.982315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:58.553459Z","title":"Hi-cmd: Hierar- chical cross-modality disentanglement for visible-infrared person re- identification,","venue":null,"work_id":"c693f362-342f-4f75-b53b-f286441b40e0","year":2020},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.328744Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:42f3960cb3e2833d33f50c15b3dc9e87b7d209b7b216ffb8448287776e8714be","observation_id":"2a156f47-a2d5-4a44-b13e-bb5c3553c503","resolution":{"observed_at":"2026-08-07T11:28:58.670654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:58.321855Z","title":"Syncretic modality collabora- tive learning for visible infrared person re-identification,","venue":null,"work_id":"83ff50e2-392a-4f5a-b464-1a3900520d1b","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.423414Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:b4bcd5d66a12b0a985bbd06bd546eaecb08e596c6a825c8998d279b0559ca0f9","observation_id":"f2d00d84-43ab-45fa-91af-d43a057a9e65","resolution":{"observed_at":"2026-08-07T11:28:58.426854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:58.031145Z","title":"Discover cross-modality nuances for visible-infrared person re- identification,","venue":null,"work_id":"d1b977b4-e06d-4b53-9889-8d778dc29a8e","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.514832Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:c617c9181169ce35fe580a72665f842ea8be50796e076b45ab8c4c2c412a37fa","observation_id":"8d4cea79-e5f9-433d-8b32-4e6f3075d856","resolution":{"observed_at":"2026-08-07T11:28:58.160276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:57.792620Z","title":"Learning memory-augmented unidirectional metrics for cross-modality person re- identification,","venue":null,"work_id":"d0904956-46f8-443c-a27a-6a089b217804","year":2022},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.617944Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e9393ce7876d810b4da57a2ea83621ec8034e934fdaf4d45558ea0c0102883df","observation_id":"62dc11d7-b98c-47e7-8c84-801816ac8f29","resolution":{"observed_at":"2026-08-07T11:28:57.897099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14626","last_updated":"2023-03-26T05:03:18Z","snapshot_observed_at":"2026-07-06T15:08:04.311574Z","submitted_at":"2023-03-26T05:03:18Z","title":"MRCN: A Novel Modality Restitution and Compensation Network for Visible-Infrared Person Re-identification","version":1},"cited_work":{"arxiv_id":"2303.14626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.14626","snapshot_observed_at":"2026-08-07T11:28:53.376961Z","title":"MRCN: A Novel Modality Restitution and Compensation Network for Visible-Infrared Person Re-identification","venue":"cs.CV","work_id":"c5ac3ae3-fda7-466c-8033-265af3279fff","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.714339Z"},"links":{"cited_paper":"/paper/2303.14626","citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:564862f4c7e5137b653d99a5715ed0821d065205778e48b8f49f0a06bdb8a09e","observation_id":"9902b856-7057-408f-b388-dae16b5580f2","resolution":{"observed_at":"2026-08-07T11:28:53.442599Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:57.534245Z","title":"Diverse embedding expansion network and low-light cross-modality benchmark for visible-infrared person re- identification,","venue":null,"work_id":"3558ca98-d571-4299-955e-296229ef8c1c","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.772131Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e93a4e7ab67aee3a1940ba9dbfd689fb08e8b09fa6451a61357d769b97d40d40","observation_id":"00dd5e75-7606-4e76-a4de-f4b67cd08520","resolution":{"observed_at":"2026-08-07T11:28:57.660780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:57.281891Z","title":"Cross- modality person re-identification with memory-based contrastive embed- ding,","venue":null,"work_id":"37aeeb56-d322-48c5-9e67-cffd4977d33c","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.849370Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:1ef9bc316eea43f0ac41bd02a080fbb6fa7a380d4c744155b80873e0604b813a","observation_id":"c2a658be-fd2d-4d31-a7b5-0fa44c7e5856","resolution":{"observed_at":"2026-08-07T11:28:57.416274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:56.992234Z","title":"Diversity feature constraint based on heterogeneous data for unsupervised person re-identification,","venue":null,"work_id":"beefe9fb-f0ed-458f-9012-41918a4bdc8b","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.907253Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:d0159b5b7c0751d0f84aabdf7ef15a687171312b33502dbe210f4a236b3e8920","observation_id":"2559b441-e8f2-4d26-9065-28d7b2942e7f","resolution":{"observed_at":"2026-08-07T11:28:57.156345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:50.968319Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:50.968319Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:a693e9b38e6734e5ab2ccf20346e9cbf6b5dad91657b0088315752df1a3f9be9","observation_id":"9f4eac1a-a882-4f88-8c66-1a273ca7686c","resolution":{"observed_at":"2026-08-07T11:28:50.968319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:56.792407Z","title":"Zegclip: Towards adapting clip for zero-shot semantic segmentation,","venue":null,"work_id":"19ad8928-e02e-409d-bf2a-5bfd550a0cea","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.039242Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:7bb50a0571b7f18fa1272d6e5d337020e50f7b338f2adac6f89f43b3c29fa12a","observation_id":"b3c86a2d-85ca-4b9a-8839-4d90a2882e7d","resolution":{"observed_at":"2026-08-07T11:28:56.909484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:56.513987Z","title":"X-clip: End-to- end multi-grained contrastive learning for video-text retrieval,","venue":null,"work_id":"bb537d4b-54f5-46ad-9fe0-4f4250773755","year":2022},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.104971Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:12cdebf780713c4d4e4e5b6177152e64ac76f70b022c594be337910eea379bd9","observation_id":"664971e6-998b-437c-83f1-f4bf2d88db72","resolution":{"observed_at":"2026-08-07T11:28:56.631811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:56.287254Z","title":"Clip4caption: Clip for video caption,","venue":null,"work_id":"164812f6-c15b-48a8-9f90-9e73ef744aa4","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.219818Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:09bf0ffe9b14b23de2c45283d1747f1e6b774051450a78f32a2f70e56b777261","observation_id":"daccd6ab-9dd0-444a-8eb6-d4b92776a1c8","resolution":{"observed_at":"2026-08-07T11:28:56.399398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:56.118535Z","title":"Towards open-vocabulary remote sensing image semantic segmentation,","venue":null,"work_id":"8bb8f130-180f-433b-90b4-193d1489344f","year":2025},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.286777Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e24854eb0d40f085fed5658b55dfdc6d44cd03ce828dc0275b40e42561c76883","observation_id":"837bdc7b-ce78-4dcd-9ff2-01869443dc6f","resolution":{"observed_at":"2026-08-07T11:28:56.187274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:55.865231Z","title":"Multi-modal understanding and generation for object tracking,","venue":null,"work_id":"b7dab916-f202-43c5-aaf4-50b71ccd81b2","year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.380360Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:f2d76a76563ff40bcd28d04ac7fed985aeea3e97e2193ce8ef3b24144dff49f8","observation_id":"46b7445f-e9d3-4420-8741-846fd3418e9b","resolution":{"observed_at":"2026-08-07T11:28:55.992680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:55.759068Z","title":"Vision-language tracking with clip and interactive prompt learning,","venue":null,"work_id":"a32370f9-f528-41eb-82a7-65ac4b3ca2ed","year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.434246Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:8188e48646edc0275425bc040bee45159104d3983dbf907b27d9ce2d3db8daae","observation_id":"7c12a972-9ae1-43d7-a4b5-b7831e7608e5","resolution":{"observed_at":"2026-08-07T11:28:55.801549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:55.544699Z","title":"Clip-driven fine-grained text- image person re-identification,","venue":null,"work_id":"0ce5c447-8151-4500-a359-15b9702f5a4b","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.582603Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e12ecd429f1616f4d2c0fd551d20db4320d8b1f78c44efe4dbe19a53cba6f597","observation_id":"c2f70d90-b90e-4fa4-932c-4b2c52f09cbd","resolution":{"observed_at":"2026-08-07T11:28:55.628971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:55.344652Z","title":"Cross-modal implicit relation reasoning and aligning for text-to-image person retrieval,","venue":null,"work_id":"918dc80c-834e-4921-9807-3e507606daf2","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.726669Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:f7a3c4d74bc4654cf2c679b5483af2d62f8890abaa36f8fd8d6c269e0efffbe7","observation_id":"bfdcada4-f2ea-4db5-ab48-743fbc4302e8","resolution":{"observed_at":"2026-08-07T11:28:55.450343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:55.149488Z","title":"Region generation and assessment network for occluded person re- identification,","venue":null,"work_id":"1d1deda0-7de3-43e1-bd7f-816e87507d8b","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:51.873196Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:98a95ce6f636aa863bf8294a8fad2b1118643da17858d5674460bce7e5add606","observation_id":"355aa486-79c2-4f54-8e28-e62124103c96","resolution":{"observed_at":"2026-08-07T11:28:55.287075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:55.032623Z","title":"Climb- reid: A hybrid clip-mamba framework for person re-identification,","venue":null,"work_id":"0f30aec4-a382-422e-977a-d12490ee0b0d","year":2025},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.075180Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:f3c0575465507349fe2abd47f842180898e44b425d7cc593bc8df06193076849","observation_id":"2f28ce96-e5c9-4de2-9c03-9230a150ce38","resolution":{"observed_at":"2026-08-07T11:28:55.086734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05806","last_updated":"2024-01-12T11:14:09Z","snapshot_observed_at":"2026-07-06T17:14:11.417758Z","submitted_at":"2024-01-11T10:20:13Z","title":"CLIP-Driven Semantic Discovery Network for Visible-Infrared Person Re-Identification","version":2},"cited_work":{"arxiv_id":"2401.05806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.05806","snapshot_observed_at":"2026-08-07T11:28:53.215110Z","title":"CLIP-Driven Semantic Discovery Network for Visible-Infrared Person Re-Identification","venue":"cs.CV","work_id":"e13ca6fc-bd4e-46f4-bf1e-923a527b3b6b","year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.222405Z"},"links":{"cited_paper":"/paper/2401.05806","citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:3749e88be9634bd8759e3e2d06462570a27348163e4529b5c3faa84389a07217","observation_id":"b8e68c0e-64bc-4eff-9952-bd2575acf095","resolution":{"observed_at":"2026-08-07T11:28:53.294008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:54.866045Z","title":"Image-specific information suppression and implicit local alignment for text-based person search,","venue":null,"work_id":"db9ba3f6-5285-4028-8d7d-74f472f81d4e","year":2024},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.338558Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:c15aa723bd61472df2a39a499a87f04d21060e2b938966c4990772483433498b","observation_id":"fef63bc4-75e1-4ce0-b44a-8865444a2de1","resolution":{"observed_at":"2026-08-07T11:28:54.920404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:54.724623Z","title":"Breaking the paired sample barrier in person re-identification: Leveraging unpaired samples for domain generalization,","venue":null,"work_id":"656c38e3-8202-41bf-a062-36896f735d54","year":2025},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.431061Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:9c05c53be918b39540a4e1b808525731500e13830be90c02bcab4ed0b44edfb5","observation_id":"b88300c7-a5f9-4e5f-8d6c-159215866fa7","resolution":{"observed_at":"2026-08-07T11:28:54.814556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:54.586226Z","title":"Learning by aligning: Visible- infrared person re-identification using cross-modal correspondences,","venue":null,"work_id":"d630df16-f2f8-4701-b79d-4cd63c2f6e2d","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.488915Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:83ec78941d2c63a9b3dc85a865735fc7fae381c26e8b7847ce11fece52adcff5","observation_id":"51116006-5425-4cad-99a1-2d785e7bd7e9","resolution":{"observed_at":"2026-08-07T11:28:54.635235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:54.478596Z","title":"Farewell to mutual information: Variational distillation for cross-modal person re- identification,","venue":null,"work_id":"c44a4c6b-570a-4c1e-a9c8-d92528aa54a4","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.562024Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:d65548ef7c4798cd9477b69427071a4f600c19b4d05e4a8e418f6acb9bb81006","observation_id":"129b85cb-0dfa-4a9e-9582-faee2983f537","resolution":{"observed_at":"2026-08-07T11:28:54.536272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:54.326272Z","title":"Channel augmented joint learning for visible-infrared recognition,","venue":null,"work_id":"ea0c23db-c6dd-4e2b-bef1-98738e728ede","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.627942Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:5891d6eeecaac7f43adc29f150073fdfb093410f1ea3db16999b623caf5ec640","observation_id":"f8a4dfd7-d1e1-4dfe-a661-c6ea7015a277","resolution":{"observed_at":"2026-08-07T11:28:54.395858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:54.163220Z","title":"Shape-erased feature learning for visible-infrared person re-identification,","venue":null,"work_id":"2a661a59-a871-40f5-a0b3-5a2599d6532b","year":2023},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.698867Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:fcad89ff394218968ef2219e579e95dddf4f5fd8f73dc5c9014e8c782248f867","observation_id":"af2e65a5-95fb-4fec-9099-89f40939cb2a","resolution":{"observed_at":"2026-08-07T11:28:54.263512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:54.060958Z","title":"Rgb-infrared cross-modality person re-identification via joint pixel and feature align- ment,","venue":null,"work_id":"a96fe444-da83-4ec8-8389-224d1d5743fd","year":2019},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.756632Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:84a5229c54283a38351bc68574f3332be3435a9db4cfd2e75e2a564965e05291","observation_id":"8a4133cf-84f4-40d0-86a4-e068b208018a","resolution":{"observed_at":"2026-08-07T11:28:54.090563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:53.926229Z","title":"Dynamic dual-attentive aggregation learning for visible-infrared person re- identification,","venue":null,"work_id":"28681417-c42d-464f-9619-936c4bc3e1e8","year":2020},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.822845Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:ae5957c0652aec5c3609cc37f33d51a43889959ba7425fd21d9959d5514d41a6","observation_id":"27efc1c3-ef46-45ec-a734-29bd12d27e82","resolution":{"observed_at":"2026-08-07T11:28:53.994840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:53.786882Z","title":"Towards a unified middle modal- ity learning for visible-infrared person re-identification,","venue":null,"work_id":"d74d2be4-9450-4543-8f3b-b8c866eb5b19","year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.889714Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:e1df21bbedc9d4b90ef8cdf8ededca1b3ddddd4de21345e90890a5686c00f738","observation_id":"6da9c9ba-09e1-415b-86d6-124f036b68c0","resolution":{"observed_at":"2026-08-07T11:28:53.853130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:53.662627Z","title":"Learning with twin noisy labels for visible-infrared person re-identification,","venue":null,"work_id":"89ea17ec-f19b-4be8-bb93-13878f767545","year":2022},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:52.948751Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:bc25d8c6d7ff2ddbd2f456379d1534ca4148eb2cd16d86170d6748b08422826a","observation_id":"7ac2d6ca-8176-433e-a06d-f3541b2b640c","resolution":{"observed_at":"2026-08-07T11:28:53.722201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:53.048014Z","title":"Tran- sreid: Transformer-based object re-identification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:53.048014Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:60fec45ab396fcda30c77f9fee81142f61a8eb797d273bc4019d9da9f6ed4d59","observation_id":"26e054bf-937a-4f39-8168-88967602e7a8","resolution":{"observed_at":"2026-08-07T11:28:53.048014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:28:53.114332Z","title":"Learning deep features for discriminative localization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:53.114332Z"},"links":{"citing_paper":"/paper/2506.02439"},"observation_digest":"sha256:7000aa81c237554a6681b3aabbd4c54742e9334765253ef358ab412a51a93398","observation_id":"7e332219-cb4b-4cb2-a338-06a2e0678539","resolution":{"observed_at":"2026-08-07T11:28:53.114332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02439","last_updated":"2025-06-03T04:49:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:21:39.809448Z","submitted_at":"2025-06-03T04:49:08Z","title":"Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":3,"verified_fuzzy":60},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2506.02439."}