{"as_of":"2026-08-18T12:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f37c210a16b176f1c749f52a6fc91bac5ad834272d44147e15b358b04b05afa2","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:54:22.502553Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.03507/citation-record","integrity":"/paper/2505.03507/integrity","json":"/paper/2505.03507/citation-record.json","paper":"/paper/2505.03507"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.879040Z","title":"Scene-dependent pre- diction in latent space for video anomaly detection and anticipation.IEEE Transactions on Pattern Analysis and Machine Intelligence, 47(1):224–239,","venue":null,"work_id":"b87c225e-b920-431a-9c3f-59dfcdc6040a","year":2025},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.387195Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:629232eddebdfcfe4c424fd863b964a8607af1574a56ddeaa812f0ae53f18bf7","observation_id":"ff32a197-f181-4f1f-b033-41f9df054e25","resolution":{"observed_at":"2026-08-15T23:54:22.882684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.836568Z","title":"Bridging search region in- teraction with template for rgb-t tracking","venue":null,"work_id":"197f3219-9cea-42d0-970d-ed33726ae6c8","year":2023},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.410556Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:4cd971d903d3f8b0fdc712e1f3a244dc4585e2c12fad6d29dee490ecc0250a82","observation_id":"17c04a49-63da-4052-b4db-296ee98bba63","resolution":{"observed_at":"2026-08-15T23:54:22.840186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.825414Z","title":"Learning collabora- tive sparse representation for grayscale-thermal tracking","venue":null,"work_id":"485505d2-4fc0-49a4-b712-327fb703d5de","year":2016},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.417704Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:dd54aa8a41c599e3da7b1e6f9d06448839b96dbf323eb6709c48d500c3d31057","observation_id":"871f869d-fb93-4bd5-abf0-4a6bbc18904b","resolution":{"observed_at":"2026-08-15T23:54:22.829393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.781182Z","title":"Motion-aware self-supervised rgbt tracking with multi-modality hierarchical transform- ers.ACM Transactions on Multimedia Computing, Communications and Applications,","venue":null,"work_id":"929a647e-ccd3-4e59-8cfb-fe0b62f7273d","year":2024},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.430896Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:23924eccb7d3bf959f54b91fb69a1c8110fcdee0f72770bcf53e12b6b6de1513","observation_id":"e49ca6fd-7e68-4ccb-89fb-67fccd8d4b4e","resolution":{"observed_at":"2026-08-15T23:54:22.786277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T23:54:22.434148Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.434148Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:334f047b6b0f32853e28d8f5fa9580197a82151a8a20d2e4530e0660ede35030","observation_id":"1d583a3c-32fe-4338-883d-716c88920ab7","resolution":{"observed_at":"2026-08-15T23:54:22.434148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.769770Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"97446fc5-7d52-4c1d-b087-22352b214379","year":2015},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.441156Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:70eb9a2b72f7a55ac8fbf8fb82b6d19825034283f5760a0f0d6f0538b9cac710","observation_id":"bace39e8-279d-4841-8f80-7f018aecee50","resolution":{"observed_at":"2026-08-15T23:54:22.773671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.748370Z","title":"S2siamfc: Self-supervised fully convolutional siamese network for visual tracking","venue":null,"work_id":"b91fe320-db77-4c2d-af8c-79a1255c49b1","year":2020},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.448073Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:c4b444857a81fbdbeedfbf2d8cd064a65ba7bd3dd4e1fcc4d0987c02d1921a84","observation_id":"c5006cef-7c78-4be1-996f-c3dd99c74ce0","resolution":{"observed_at":"2026-08-15T23:54:22.752025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-15T23:54:22.451978Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.451978Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:a257f0158aa037eb0ab130f0dc086770aa9e59c9759a60abe7e967c55e0a303e","observation_id":"6822dda5-353b-4791-b151-f2cc2306caa5","resolution":{"observed_at":"2026-08-15T23:54:22.451978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.736744Z","title":"Datfuse: Infrared and visible image fusion via dual attention transformer.IEEE Trans- actions on Circuits and Systems for Video Technology, 33(7):3159–3172,","venue":null,"work_id":"4c5f7871-d96d-4491-9048-e94c60045251","year":2023},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.455379Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:35eac04946c557a15d2d00b164d9f4fee64e9b2a62a1117fcd4db3006605e6e7","observation_id":"a8290b41-1cb4-48c2-994b-fe6a74f4f553","resolution":{"observed_at":"2026-08-15T23:54:22.740651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.725944Z","title":"Generative-based fusion mechanism for multi-modal tracking","venue":null,"work_id":"21209560-534b-470e-bfcb-02232ef82524","year":2024},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.458954Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:d51c81ef1e37387e1ea53a8dccf30188e71b6dd39a517bd18915d00afbd99c3c","observation_id":"b18e44da-7283-41bd-beb3-40aa634a6fcc","resolution":{"observed_at":"2026-08-15T23:54:22.729553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.462330Z","title":"Attention is all you need.Advances in neural information processing systems, 30,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.462330Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:cc4d61dc5bdb555aaeca855893f8d9af674b61c8bfaf4f14d4acb9ab1207a7b3","observation_id":"495a9953-0eb6-4c0b-a7b4-324626f6a249","resolution":{"observed_at":"2026-08-15T23:54:22.462330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.709136Z","title":"Graph attention networks.stat, 1050(20):10–48550,","venue":null,"work_id":"c6e28769-41be-4a08-9124-9dba843055fa","year":2017},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.465840Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:b5aed538a8107eb4c875dabd4d2110fa3e543f1e1e6a8fef51bdf3a2f5d5a1cb","observation_id":"c6f56b12-c4b8-47d0-b37f-bfdd455e467d","resolution":{"observed_at":"2026-08-15T23:54:22.712610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.699256Z","title":"Unsupervised deep tracking","venue":null,"work_id":"a468b1c9-e027-4cc0-906d-a4569726055b","year":2019},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.469094Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:850f050507d83f997d58ee270884937362ac6bda852a9d47624724491d6f10fb","observation_id":"e07c88fa-cd21-418e-8598-86f5f3b9c4d2","resolution":{"observed_at":"2026-08-15T23:54:22.702633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.687850Z","title":"Mfgnet: Dynamic modality-aware filter generation for rgb-t tracking.IEEE Transactions on Multimedia, 25:4335–4348,","venue":null,"work_id":"11f298e0-abf6-4458-a760-3d38c9f6467c","year":2023},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.472408Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:83d45121b225cb75c112bb076d7a7df834d7eb7df001c79b55f0300e60635fc4","observation_id":"bfea15c5-ff45-4a6e-a67e-fffdc307ac77","resolution":{"observed_at":"2026-08-15T23:54:22.691957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.677575Z","title":"A dynamic feature interaction framework for multi-task visual perception.Int","venue":null,"work_id":"277c824e-ca39-4974-bf10-32e8fc484fc9","year":2023},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.475747Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:ba344e2b58e3d075923d2ef2e34d3906bb96160d03a439096106067313ae154f","observation_id":"91f7b8e6-c605-4033-a844-eb0637b080c3","resolution":{"observed_at":"2026-08-15T23:54:22.681195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.667469Z","title":"Multimodal cross-layer bilinear pooling for rgbt tracking.IEEE Transactions on Multimedia, 24:567–580,","venue":null,"work_id":"927660b1-f22c-4c93-85c8-5150c4affd05","year":2021},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.478855Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:26e9776548b12c812b42b792e2e425bf43d4fc48170f9b2dee404cdc6871b7d4","observation_id":"62545e22-7909-4924-91f0-ec9cd5338d2d","resolution":{"observed_at":"2026-08-15T23:54:22.670962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.655943Z","title":"Meem: robust tracking via multiple experts using entropy minimization","venue":null,"work_id":"d768c716-9abd-4331-bb4c-b2185958fcb0","year":2014},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.482097Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:8cf4cb74a6f778876d03bf2d74d1f5453e3096390c85e0d32f0063e91b3cef59","observation_id":"dc3c6c2e-c650-4c96-8a43-e00b1c843ceb","resolution":{"observed_at":"2026-08-15T23:54:22.659497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.645346Z","title":"Multi-modal fusion for end-to-end rgb-t track- ing","venue":null,"work_id":"85f71803-a1a8-4df3-857d-3bce731a69ca","year":2019},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.485427Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:9d39c17d74ac78413a1e8b393254fdb9ece04752dbe712b69f60336b7b626c59","observation_id":"a5c7bf1e-784a-4284-b280-9271c794b42e","resolution":{"observed_at":"2026-08-15T23:54:22.648920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.634419Z","title":"Visible-thermal uav track- ing: A large-scale benchmark and new baseline","venue":null,"work_id":"7b1273d6-e521-44a7-9425-e781360b2193","year":2022},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.488719Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:d2fd87f4ce82244a0c9035503d26aed9d0b3b76c2861ac1e3ca0df73e881ef5c","observation_id":"27b823ee-621f-4065-93c9-9790d97c3f94","resolution":{"observed_at":"2026-08-15T23:54:22.637988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.624008Z","title":null,"venue":null,"work_id":"32ffdd1a-9819-4134-8a58-09b12c44df8a","year":2024},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.491864Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:d7bed3661536839335425d5fc299962f69baf4d1f55074f61c85ddb329383e00","observation_id":"9cbc1a57-c0c7-4cca-be63-dfcfcb385282","resolution":{"observed_at":"2026-08-15T23:54:22.627403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.612803Z","title":"Diff-tracker: text-to-image diffusion models are unsupervised trackers","venue":null,"work_id":"c2a2c606-5ace-4cb2-bd3f-64671cbe7804","year":2025},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.495570Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:f8f1eb628d2e749528dc066c5da2a03de4ebe6b5f1e0ee548c1ece7f4ad8abdd","observation_id":"bf5eb6ac-3601-4fa3-8d93-68978dc85e67","resolution":{"observed_at":"2026-08-15T23:54:22.616557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.601199Z","title":"Learning to track objects from un- labeled videos","venue":null,"work_id":"05b5435a-f381-4467-9fa7-ceb20e5d69b0","year":2021},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.499129Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:43f6a2b485ef7f1b91fa30a663731bcdfdcdd1a7593a74c4350e884a11342610","observation_id":"22d33709-f07a-4877-94f4-024935b3f9a6","resolution":{"observed_at":"2026-08-15T23:54:22.605156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.587916Z","title":"Visual prompt multi-modal track- ing","venue":null,"work_id":"038c9c01-822b-41a4-9cfa-f8d5d7fa8d12","year":2023},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.502553Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:99bd4d08577e54fd47306326034ab98148f3bf9a8b0bbca00d9590a967ae20c7","observation_id":"6bcc063a-1bd7-4807-86b6-b8f668761085","resolution":{"observed_at":"2026-08-15T23:54:22.593253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15691","last_updated":"2024-12-20T09:10:17Z","snapshot_observed_at":"2026-08-15T12:09:42.108652Z","submitted_at":"2024-12-20T09:10:17Z","title":"Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15691","snapshot_observed_at":"2026-08-15T23:54:22.406317Z","title":"Exploiting multimodal spatial-temporal patterns for video object tracking.arXiv preprint arXiv:2412.15691,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.406317Z"},"links":{"cited_paper":"/paper/2412.15691","citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:013a69652b3423a5739b5247cc39ce9276560c7b06a8cecd78c5c230e3d5d64f","observation_id":"af01de1f-061b-4a94-a8fe-92772fdce9ce","resolution":{"observed_at":"2026-08-15T23:54:22.406317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.759055Z","title":"Unsupervised learning of accu- rate siamese tracking","venue":null,"work_id":"e22adc9d-df55-4b02-8af0-a7a13fd7b46c","year":2022},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.444624Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:51e9cc8f747deeea5e4d6fd3324e93367ef3dccc4ff78cb8fee2a042f362ca61","observation_id":"3d7d8c6a-b3cc-4d65-ad30-78a14459f023","resolution":{"observed_at":"2026-08-15T23:54:22.762759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.815000Z","title":"Rgb-t object tracking: Bench- mark and baseline.Pattern Recognition, 96:106977,","venue":null,"work_id":"7e63debf-1e86-4502-b0a5-a7e6133fd1fb","year":2019},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.420987Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:c0d233416b8b44f357e1f600e9f44cf89558f4b2848983002bb097b47421f5d8","observation_id":"84e5edea-c732-45a7-a809-ad61a637f414","resolution":{"observed_at":"2026-08-15T23:54:22.818694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02717","last_updated":"2024-05-04T17:24:09Z","snapshot_observed_at":"2026-08-16T13:55:23.776788Z","submitted_at":"2024-05-04T17:24:09Z","title":"AFter: Attention-based Fusion Router for RGBT Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02717","snapshot_observed_at":"2026-08-15T23:54:22.437614Z","title":"After: Attention-based fusion router for rgbt tracking.arXiv preprint arXiv:2405.02717,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.437614Z"},"links":{"cited_paper":"/paper/2405.02717","citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:3f98eb75c36e06a09bc6bc793fc498511e6a0bdce5b7106958f2055e9aeb6b96","observation_id":"2efbeb26-e62d-4373-a5bc-6d083fbb0c09","resolution":{"observed_at":"2026-08-15T23:54:22.437614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.804619Z","title":"Lasher: A large-scale high-diversity benchmark for rgbt track- ing.IEEE Transactions on Image Processing, 31:392–404,","venue":null,"work_id":"69fb7c62-981a-4ea9-97cd-272c0f2e84d3","year":2021},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.424277Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:b9bba01274fafdf23b18d4e7acce65a26d4953bd0334a964a4d3a52a6dec86d5","observation_id":"25a41da2-6c13-4c38-9944-7c1310e9d0f1","resolution":{"observed_at":"2026-08-15T23:54:22.808462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.847515Z","title":"High-speed tracking with kernelized correlation filters.IEEE Transactions on Pat- tern Analysis and Machine Intelligence, 37(3):583–596,","venue":null,"work_id":"7889ed4d-9aaf-4c6c-9bed-bd0fe4cd967f","year":2014},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.402560Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:b90d737a0c9b2fd5eb54d78caaf82eff113032012fa5774ab464342b7596c6dc","observation_id":"b485a159-b3cf-459f-a465-b995124a9de3","resolution":{"observed_at":"2026-08-15T23:54:22.852233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.793299Z","title":"Unsupervised rgb-t object tracking with attentional multi- modal feature fusion.Multimedia Tools and Applications, pages 1–19,","venue":null,"work_id":"54bed8e7-eea4-46db-a6b9-cfdb43ba59e6","year":2023},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.427427Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:cd190bc8835b1e3587da8e0f0806f2bc56396731015b3b6120b04d00288a0304","observation_id":"dae23369-84e8-45cb-804a-cfee74ea824d","resolution":{"observed_at":"2026-08-15T23:54:22.797549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T23:54:22.398481Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.398481Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:2e6b95feaf71f67bb24e97f21b41263d7a7b74372ca0fc0d7f2894abd37ddda5","observation_id":"e969eb8e-23ad-4771-964b-850884ea4702","resolution":{"observed_at":"2026-08-15T23:54:22.398481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07889","last_updated":"2024-08-15T02:29:00Z","snapshot_observed_at":"2026-08-17T15:04:46.179445Z","submitted_at":"2024-08-15T02:29:00Z","title":"MambaVT: Spatio-Temporal Contextual Modeling for robust RGB-T Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07889","snapshot_observed_at":"2026-08-15T23:54:22.413931Z","title":"Mam- bavt: Spatio-temporal contextual modeling for robust rgb-t tracking.arXiv preprint arXiv:2408.07889,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.413931Z"},"links":{"cited_paper":"/paper/2408.07889","citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:407c2efe84b79a1f9e72733b5ebfc439815071dcc20e0ee8ee6584c88988b8af","observation_id":"19d42de4-dc7c-44fa-832a-bdc2e2add454","resolution":{"observed_at":"2026-08-15T23:54:22.413931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.858770Z","title":"Mixformer: End-to-end tracking with it- erative mixed attention","venue":null,"work_id":"b9f7a34d-1a47-4808-be18-ae94e2f6b4cf","year":2022},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.394910Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:7f5665701b314e485305c563eec16d86f43ffc2e338c8b05d14265cb6771bceb","observation_id":"20290fe2-172f-4fd3-b24f-61287f47b4b0","resolution":{"observed_at":"2026-08-15T23:54:22.862730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:54:22.869220Z","title":"Unified sequence- to-sequence learning for single- and multi-modal visual object tracking,","venue":null,"work_id":"695c7cd7-8151-451a-950f-3a7e37199c63","year":2024},"citing_paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T23:54:22.391334Z"},"links":{"citing_paper":"/paper/2505.03507"},"observation_digest":"sha256:296fd65069b7e544d7f97b09e5807f7081d956e8b342761b75713f53f4cba7df","observation_id":"ce6cd389-d828-4caa-a2d6-85337aed8051","resolution":{"observed_at":"2026-08-15T23:54:22.872694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.03507","last_updated":"2025-05-06T13:15:34Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T23:47:45.949926Z","submitted_at":"2025-05-06T13:15:34Z","title":"Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2505.03507."}