{"as_of":"2026-08-16T19:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4564539a8d5fa5c253ab4c476fe6bfaa605b8ab5cab4eee1cfdb79fc832a7fc3","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:08:04.039563Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:16:24.593576Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-14T12:16:24.630242Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"cited_work":{"arxiv_id":"1908.03737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.03737","snapshot_observed_at":"2026-08-14T12:16:24.630242Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","venue":"cs.MM","work_id":"91a67e03-8722-46fd-81d0-b0d999a9c1fa","year":2019},"citing_paper":{"arxiv_id":"1908.07673","last_updated":"2019-08-21T02:04:18Z","snapshot_observed_at":"2026-08-14T11:57:48.382261Z","submitted_at":"2019-08-21T02:04:18Z","title":"Learning Joint Embedding for Cross-Modal Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T12:16:24.593576Z"},"links":{"cited_paper":"/paper/1908.03737","citing_paper":"/paper/1908.07673"},"observation_digest":"sha256:3180a2e2b190bd77f7b10d3c8557b06b78e56b2ca308e43c2598c4e628241612","observation_id":"eac51361-2138-49b5-9d5f-a0a244d53a8b","resolution":{"observed_at":"2026-08-14T12:16:24.638969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.03737/citation-record","integrity":"/paper/1908.03737/integrity","json":"/paper/1908.03737/citation-record.json","paper":"/paper/1908.03737"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1609.08675","last_updated":"2016-09-27T21:21:49Z","snapshot_observed_at":"2026-08-14T21:37:52.670253Z","submitted_at":"2016-09-27T21:21:49Z","title":"YouTube-8M: A Large-Scale Video Classification Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08675","snapshot_observed_at":"2026-08-14T14:08:03.778072Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.778072Z"},"links":{"cited_paper":"/paper/1609.08675","citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:8c83ae01f4dac70de7c1837a4e814e297d31c1d9c4b64db953df1855f1768220","observation_id":"53b14a61-f036-4c58-a3df-b4b88306a454","resolution":{"observed_at":"2026-08-14T14:08:03.778072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4324/9781315755649-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.324405Z","title":"Bilmes, and Karen Livescu","venue":null,"work_id":"5d40fec1-c99c-4715-96f4-98ceae67a1cf","year":2013},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.782884Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:518902633ab5174eac6aa2f8391574c92a22c43e8d9f70a8b46880fd5b290e9b","observation_id":"beae13b7-83b9-4456-a935-f3372213c495","resolution":{"observed_at":"2026-08-14T14:08:04.328402Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.787535Z","title":"Henriques, Andrea Vedaldi, and Philip H","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.787535Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:92de209f7180fa9813a704c75a3e1c53d043c9be66042981a1d7d2f8fee47e32","observation_id":"1f49a79c-2e85-415f-bbc2-90a6c6cb7a5c","resolution":{"observed_at":"2026-08-14T14:08:03.787535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.792357Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.792357Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:32d974724db919b8eea977abfb4f5045fdf29180c62c58f4da3fbd40ee473b8c","observation_id":"3e48c3f3-1776-4722-9f7d-6a60b9d3c603","resolution":{"observed_at":"2026-08-14T14:08:03.792357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.797116Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.797116Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:d56350e16de0c577e0f2acf4c0ce6691aab41889a07606583fe4a0cf599c0ff8","observation_id":"7f985525-4ec9-4cff-b25f-5d7f1e2997c8","resolution":{"observed_at":"2026-08-14T14:08:03.797116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/2808205","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.296900Z","title":null,"venue":null,"work_id":"3eb0dd7b-376b-4c53-9d7b-d271eb4c395e","year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.801231Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:713f2e56068c542d76fef7c9edb079e9c458f0fbda842e17192ab58cd5f31c28","observation_id":"7bab52c1-0764-4370-a7c3-5da4e5125277","resolution":{"observed_at":"2026-08-14T14:08:04.301246Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.805983Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.805983Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:c369a48d09291e6679f1f3a10c4d6d5a7c0dfacc009b6d9e3ae9be38bb7c0879","observation_id":"230c2025-84b5-4973-9c83-0a0bdf68d67c","resolution":{"observed_at":"2026-08-14T14:08:03.805983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:06.026465Z","title":"Hardoon, Sándor Szedmák, and John Shawe-Taylor","venue":null,"work_id":"ff55cfdc-000e-4374-8157-becc521c5a5f","year":2004},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.810888Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:d1f1de81fad1e47294ad65b38dce004a5d70a35a7682c41d2ef8c24629e36265","observation_id":"014227b0-b86c-47d0-a826-e2eb57230b1c","resolution":{"observed_at":"2026-08-14T14:08:06.034104Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.80195","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.572533Z","title":null,"venue":null,"work_id":"62d620df-77b5-461a-8fb3-61fd179606f0","year":2017},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.815393Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:bcca9c5f7686f31b0ff869a7cbb1083ad23a745a690cb738a2d9bcf3dd15c461","observation_id":"dc262e54-b94d-4fac-9eb2-536ace40dfb4","resolution":{"observed_at":"2026-08-14T14:08:05.578604Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-14T21:10:31.788257Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-08-14T14:08:03.819397Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.819397Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:631d1c48e250ce716160b9097feb20254be7b8c76390f67711b0d6c9377adfcb","observation_id":"319d4947-9f13-4afa-a9bc-f3a0477ef6aa","resolution":{"observed_at":"2026-08-14T14:08:03.819397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.824394Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.824394Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:e97c68d03d77b14f86e42d84f636f1bc1371a547ef45071ec9f5d531b91f6556","observation_id":"96f58d85-9dc4-484f-bbaa-99e3cb9fb862","resolution":{"observed_at":"2026-08-14T14:08:03.824394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:06.010036Z","title":null,"venue":null,"work_id":"b646001b-ffd9-4acf-aa03-743135a72763","year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.828693Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:fe529df777f774180762cfd139c14a4b7f2d0de7526508140e66e51154aa975c","observation_id":"b2d8d374-41b5-4fb6-8f42-a15b954d0ae7","resolution":{"observed_at":"2026-08-14T14:08:06.015187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2015.219","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.284257Z","title":null,"venue":null,"work_id":"f274e4c6-4d8a-4504-ae44-8ab24c9934cd","year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.833595Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:f7b7eddf220db1bad10d07f4adcede45ca07b851e12e8f8d278c3859a6dcc409","observation_id":"96b4c8b7-2239-4634-8ea8-8126a7ae9019","resolution":{"observed_at":"2026-08-14T14:08:04.288256Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.neucom.2018.12.037","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.270881Z","title":null,"venue":null,"work_id":"9b0d4bc2-5f51-457e-b557-69a1d005f39c","year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.838927Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:44a2713083c160ccbe37e900feae46781cfcd5565018cc8101d9d1c6761fff94","observation_id":"9929f439-c2e1-4c6a-989e-eec13c5da921","resolution":{"observed_at":"2026-08-14T14:08:04.274908Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.993740Z","title":null,"venue":null,"work_id":"4e68364b-bdd6-4554-b8b7-4b080321706b","year":2014},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.843410Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:ab9ffef671c3a3f5bfc64535d57daa3ddf14492263651012bd20046ce40b03cb","observation_id":"fd450849-164e-48c9-9320-8001dc5aebf0","resolution":{"observed_at":"2026-08-14T14:08:05.998919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.847760Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.847760Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:26d6364fb7ee96dbc38259033625b4f12d9edd9ee06d59528dcfb8ba2a1362ef","observation_id":"b353ab4b-5408-4537-9a80-a06edf3d7892","resolution":{"observed_at":"2026-08-14T14:08:03.847760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1142/s012906570000034x","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.249403Z","title":null,"venue":null,"work_id":"a95646ec-1eb2-42db-bfb0-876366bdac42","year":2000},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.852025Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:b6668350ed2d261e82e0a32f4a5b57df356bae3de673169973290643dc6276e9","observation_id":"d9e509bf-5e47-4d11-b391-2f09843ac78d","resolution":{"observed_at":"2026-08-14T14:08:04.253344Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7013.95714","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.428592Z","title":null,"venue":null,"work_id":"fbb3fb5a-b2a3-4db2-bc67-893267afb241","year":2003},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.856095Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:1905b74601db6cd26804503ab7b4610323fe074b28335aa5fdcbb04829dd1476","observation_id":"4f7211db-8812-4f8d-a789-289e4274fe00","resolution":{"observed_at":"2026-08-14T14:08:05.436675Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2017.309","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.235689Z","title":"Manmatha, Chao-Yuan Wu, Alexander J","venue":null,"work_id":"65075ecd-2bf4-4fdf-82a7-3b1b7d3a753c","year":2017},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.860365Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:3af8bcbba3fc77ee7ebe17442916ccbced46a0ef0014a3411df2f47706d013ea","observation_id":"d9d23a30-646f-4867-aaeb-77d411cba249","resolution":{"observed_at":"2026-08-14T14:08:04.240805Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.978467Z","title":null,"venue":null,"work_id":"20e48fe0-3a34-471a-be3f-26941e5486b2","year":2011},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.865208Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:129f1308bbdefd80dd68744ba042913ba84789e95f46d2a42821fc4eee14fcd4","observation_id":"71ed3f22-c494-45c9-8ac3-d82d0bb61c88","resolution":{"observed_at":"2026-08-14T14:08:05.983831Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.963699Z","title":null,"venue":null,"work_id":"0beb2e7a-5aa1-4aa9-b07e-079d6af386d0","year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.869010Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:fc7a34314fd2c56f82297251d1f5dc788d4b57f395d6ab04b152fcf763c2cef6","observation_id":"7cce9e2e-2934-48e3-b71f-d001280ec1a7","resolution":{"observed_at":"2026-08-14T14:08:05.968382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.948955Z","title":null,"venue":null,"work_id":"cec05066-f68a-4ab9-a2a3-1d9752eebd30","year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.872765Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:be39b5fe4b6b9b31aef838e568a19fdb3dc8ce70bb9b9db857e14c39011bac6f","observation_id":"d981e181-ad88-4c16-9774-ee799ac5af44","resolution":{"observed_at":"2026-08-14T14:08:05.954099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.935000Z","title":null,"venue":null,"work_id":"a45089db-2538-4dc2-a2bb-44ed9f2fe50c","year":2018},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.876676Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:c7b54dacfc418c06552aeb8a34ce295b97eb8234d4afb02283dca6578653c7ba","observation_id":"37150d9d-76d7-4553-aa0a-e042ab16c436","resolution":{"observed_at":"2026-08-14T14:08:05.939737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.918867Z","title":null,"venue":null,"work_id":"de418719-ad81-41e7-8c33-067e097f4ab7","year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.880392Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:305027048cf942e3d3c971a996ac2863bc0d0c2d699d796db17cca0dd5b7a897","observation_id":"f28076ab-db95-450e-b164-7898fe2a61ca","resolution":{"observed_at":"2026-08-14T14:08:05.924281Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1201/b18358-8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.222018Z","title":null,"venue":null,"work_id":"14f2aae0-0571-4b27-9298-a324f17962a8","year":2014},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.884290Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:6948522d9ccfce551fb17b3247bba5e7a2e701b0d3a3fd95282561530b155621","observation_id":"06eed2eb-c2d7-45fa-b7ff-1ba9d32389e2","resolution":{"observed_at":"2026-08-14T14:08:04.226527Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3951.18739","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.344083Z","title":null,"venue":null,"work_id":"a8fffe73-ffe3-43e7-b78b-d94ff7597d03","year":2010},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.888554Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:1a74111591657baef7ea87e4cf51ec991229bdecdd3db6942d6d2b021d04505c","observation_id":"7f7e122b-5794-4909-b4e2-977c62f4c671","resolution":{"observed_at":"2026-08-14T14:08:05.349617Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.904662Z","title":null,"venue":null,"work_id":"e5cec8a2-5f04-427f-a3bd-941731f68bb1","year":2013},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.893849Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:116afb1718494326fcdd6648241e41302300e099eb879723135e7ddc485aea36","observation_id":"cc2ba9a8-2985-484f-8f64-d2b07a700f9a","resolution":{"observed_at":"2026-08-14T14:08:05.909658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.897699Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.897699Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:06a5478c808ab20bb8fb8261d58722f51df32d272d6c4bd669ae624908d578c6","observation_id":"4f03ca53-4618-4466-9769-7291e82e1f1a","resolution":{"observed_at":"2026-08-14T14:08:03.897699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.905523Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.905523Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:8d1c2d96b60d316e2b36cb96f9fb4c887738e9ba9b1366e000bb8f73917e4649","observation_id":"b8143e21-ebbf-4a09-9c61-738cbf54daab","resolution":{"observed_at":"2026-08-14T14:08:03.905523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.880592Z","title":null,"venue":null,"work_id":"e1b63b93-3fb8-460b-9c03-a04d69d7b8ea","year":2012},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.909551Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:73635c2dc6f8d015b10a6eabb1d987ce56829c81d1e6fb4d913f36fe56709e12","observation_id":"ad332e67-ce06-4961-9259-60a2d84635a0","resolution":{"observed_at":"2026-08-14T14:08:05.885109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.913274Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.913274Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:57f01e16ea89186eb4f24ef57a7a4d5fcaaeb08d0f9298fff1f06ceeccb3eb4f","observation_id":"a8162538-9cad-4217-870f-b2710434ea16","resolution":{"observed_at":"2026-08-14T14:08:03.913274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.866288Z","title":null,"venue":null,"work_id":"7fe687e4-bdc0-4684-a040-97aa215c2325","year":2011},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.916814Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:eee59fd56224210733b886318787786b0fd4ac8cce0cd8635a552a2d66e33f61","observation_id":"c60f928d-abd9-4d0a-9fd5-226e79fa03da","resolution":{"observed_at":"2026-08-14T14:08:05.870854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3309881","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.209166Z","title":null,"venue":null,"work_id":"fbd4022b-3291-41bb-a31f-2dcef3cf6104","year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.920801Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:0882ab4e4b90ef175325be738e65ed6780801cbd5b2c120d7039b4d419f120c4","observation_id":"94d67a8e-79c0-4e21-b4e0-ef1e58115c18","resolution":{"observed_at":"2026-08-14T14:08:04.213598Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/icdm.2012.30","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.194660Z","title":null,"venue":null,"work_id":"c0c3d9fe-df2a-4e5f-9a77-eb390bb86ecc","year":2012},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.925852Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:5d16abbf06b6fdb8aa95d431cd87f2718ceb9fc5d514aed541ffa004a6a5d4f4","observation_id":"b2c499e1-761c-416e-8264-07d2d8e6d998","resolution":{"observed_at":"2026-08-14T14:08:04.199849Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12386","last_updated":"2020-03-26T13:43:25Z","snapshot_observed_at":"2026-08-12T13:21:19.700452Z","submitted_at":"2020-03-26T13:43:25Z","title":"A New Gene Selection Algorithm using Fuzzy-Rough Set Theory for Tumor Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.12386","snapshot_observed_at":"2026-08-14T14:08:03.929742Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.929742Z"},"links":{"cited_paper":"/paper/2003.12386","citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:35be165e3d2530913dea3a1f8f026b1e13b85f3a6d00f623f77fb28672ee3c10","observation_id":"2c631c74-ee6d-449c-b7af-debe09e97c78","resolution":{"observed_at":"2026-08-14T14:08:03.929742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2010.55401","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.091810Z","title":null,"venue":null,"work_id":"0c82ad5d-8080-46a3-98a8-52264c2ab0b7","year":2010},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.934240Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:49fb2eca934f195d396b3c124bbc025885d76bf9b6cde98e846a7cad3be323bc","observation_id":"95028e9a-e521-42f2-88b4-be8d74c4d9c0","resolution":{"observed_at":"2026-08-14T14:08:05.097565Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.844786Z","title":null,"venue":null,"work_id":"526fb790-7c71-46c9-840f-61d67c9f7091","year":2017},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.938454Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:230e98eb848f1eda9338f32972c992cbc9b9f54fffab93c801ea8b71c7ea9b3f","observation_id":"1f66b2bc-874e-45e7-bb0e-d68aa0b1c9c5","resolution":{"observed_at":"2026-08-14T14:08:05.856679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.942389Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.942389Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:03e01995471f4534a0cd7129f81895283aace9cb124880acb8f60428f183f6cf","observation_id":"00267b25-5389-4bc4-a59f-3e158d2f1582","resolution":{"observed_at":"2026-08-14T14:08:03.942389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.946354Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.946354Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:90e18c5f2c75be1d02d3e9d6e153562238a8f88f05c2ff1dd2ac9784dee03610","observation_id":"3496216a-6d68-4f56-a7d9-77757b61bf99","resolution":{"observed_at":"2026-08-14T14:08:03.946354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/ictai.2015.45","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.172501Z","title":null,"venue":null,"work_id":"8e364b22-8659-4149-918b-dacd2fdb4f7f","year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.950084Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:969652fc5376df2c65ee950e7688bbf9f51c70b1cc37243dd18fb045365eadd5","observation_id":"f1e96d6d-f0e0-4d25-9b38-1eec2200e9e4","resolution":{"observed_at":"2026-08-14T14:08:04.177290Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.830923Z","title":null,"venue":null,"work_id":"cfe67e70-7bb4-4c96-8aa2-badadd068c64","year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.954145Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:07af05f09b9aa1c8daacefe53bb4218c1946b263352ce2b514a56f598bec64ed","observation_id":"4e7efc7f-7022-4b2d-b524-fdeab074df77","resolution":{"observed_at":"2026-08-14T14:08:05.835723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.959052Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.959052Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:b9adcb15bf3df286d39bf296bc9fc73429154c44cfb73e1243cb31aee316d665","observation_id":"b75d28f3-bb53-4506-b1d0-bcec63ec18bf","resolution":{"observed_at":"2026-08-14T14:08:03.959052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2013.261","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.159629Z","title":null,"venue":null,"work_id":"192d1a3a-9820-48cd-b763-90facabd65b1","year":2013},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.963049Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:f191572c81445370c46fc6ef0122a15ee1ada77b4c2b48ecf23ef7832ec2a4a8","observation_id":"cfd703f8-8f3c-4521-8282-5f46b7b32bbb","resolution":{"observed_at":"2026-08-14T14:08:04.164419Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/cvpr.2016.541","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.146238Z","title":null,"venue":null,"work_id":"64dda6c5-de3f-4694-b810-d0c0e454e933","year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.967062Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:301f20816a9494b09c58af3cde1564768a824b8d13796fa45f0a4883f20debb9","observation_id":"0078b885-23ce-4c62-8cd2-a51dd1b2d79c","resolution":{"observed_at":"2026-08-14T14:08:04.150780Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3340262","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.133355Z","title":null,"venue":null,"work_id":"0655f6ca-30c8-4a5a-8ca3-f2859ded0575","year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.971143Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:10998211982ad9883cf426fc1a89ae0a2e51aeda73a444a585da4b84f53cec6a","observation_id":"e889c7a3-2e44-4955-b74b-10888113db47","resolution":{"observed_at":"2026-08-14T14:08:04.137444Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.818470Z","title":null,"venue":null,"work_id":"d279eed8-e136-4482-a1fa-afc250a3a4b0","year":2013},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.975078Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:4dfeafb499516432a377613852a33b892d0a252fb485916bb458b76f1bf47728","observation_id":"1f9aed25-5dcf-4cd9-b60a-1c0300a8935b","resolution":{"observed_at":"2026-08-14T14:08:05.822586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.805203Z","title":null,"venue":null,"work_id":"0065d035-5a2d-4499-9e08-297c107e7714","year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.978967Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:0b5931f01d46b56d8e1c2f944aa122af543f837578d853a191f95204597568ad","observation_id":"d3c7d9cc-0638-44a0-a857-f39ac5a91735","resolution":{"observed_at":"2026-08-14T14:08:05.809820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.791904Z","title":null,"venue":null,"work_id":"f8ff590e-53d2-413e-8777-fc595fd2e074","year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.984030Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:b7e71ec343cc0a0b79162822c191f41d7922cd196bce164e2a2d3e46539f7789","observation_id":"d2b57ba7-4dc2-407d-9926-114762a36f76","resolution":{"observed_at":"2026-08-14T14:08:05.796491Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.987873Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.987873Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:e7c9735430234d44305adde0bc0fd1315744147c5d1c5c41e8b9c8db8c2a57c2","observation_id":"1a1cda81-ab85-480e-ac78-f25d264d3eb4","resolution":{"observed_at":"2026-08-14T14:08:03.987873Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.779504Z","title":null,"venue":null,"work_id":"14ea81a4-fe9a-43eb-bdb1-01b0a6928c61","year":2017},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.991981Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:ea7462b3284cc97042fc2980422ff9897f7179d75c181fd645f66752a08db20d","observation_id":"282802fb-80af-4685-b2c2-7d502b6ae1ab","resolution":{"observed_at":"2026-08-14T14:08:05.783947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.995966Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.995966Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:bdd578f4980330c18e27b294c7241cbe5018ab239547e7baf7278daf13ee4f93","observation_id":"c9e09226-40f6-4d3b-9556-222f7f9f3e61","resolution":{"observed_at":"2026-08-14T14:08:03.995966Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.26029","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.578966Z","title":null,"venue":null,"work_id":"50d7cc6a-fdd8-48b0-a6d3-0d9a2caa1d6d","year":2016},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.000189Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:56d56f6b64e8e8d4d9eee37f95506eb258ed18b60e6093d2d72df20662dd2e50","observation_id":"63b7e88f-b399-48d4-aa56-bc4c87adea1c","resolution":{"observed_at":"2026-08-14T14:08:04.585500Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/10.1109/tpami.2011.170","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.121065Z","title":null,"venue":null,"work_id":"85e019be-3eb9-401b-8e76-68ea79a3522e","year":2012},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.004286Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:c5008c4f117727cbadf49516460ece7d8240fb96d06dd328ba30b4edefa19680","observation_id":"ce81daf8-23dc-4a66-9d82-69143dac74ea","resolution":{"observed_at":"2026-08-14T14:08:04.125028Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.765718Z","title":null,"venue":null,"work_id":"a8b49b8a-baf9-46fe-9989-f51507a3d4db","year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.008615Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:29dc6fd12deb68adf43dff35ea99a689b1c3b694d37419ee4514f360122e2f03","observation_id":"58b13990-7b2a-407a-863c-7a9bdad88d7e","resolution":{"observed_at":"2026-08-14T14:08:05.769653Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.752935Z","title":null,"venue":null,"work_id":"d426c0de-799a-4c6f-9447-1b2e356db800","year":2018},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.012894Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:d3e41cbcf131221c68311f770281970f9a4e2cd826160e9362c3b36c23b39824","observation_id":"988c07f3-5ba6-4059-87c9-8258b9ca54e4","resolution":{"observed_at":"2026-08-14T14:08:05.757777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.017288Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.017288Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:3b38258c69ed3f875620f85d278ac57a59223f2f3febefb34a27477406eef563","observation_id":"3c8508db-4de5-4570-998f-57be55b64676","resolution":{"observed_at":"2026-08-14T14:08:04.017288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/ism.2018.00-21","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.099423Z","title":null,"venue":null,"work_id":"5429cf48-7d57-4575-ba55-acb9b0661183","year":2018},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.022818Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:1b40a7e8db4ff492238bfcb586ec497f28a62bcf5f5c0eaee4c175754fc94f72","observation_id":"aa8a7b66-76f1-41d5-b841-47fb45a1582d","resolution":{"observed_at":"2026-08-14T14:08:04.104209Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:05.740504Z","title":null,"venue":null,"work_id":"4e30b53b-86e9-4eba-8c47-fd1bb9dc19d7","year":2018},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.027184Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:97cbbd94d7e5be737c0819ae2e98f260c1b3cb73506719a1bfa09f51051fe006","observation_id":"66a897de-5287-4275-85bc-b62126494c08","resolution":{"observed_at":"2026-08-14T14:08:05.744686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/cvpr.2014.178","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.086959Z","title":null,"venue":null,"work_id":"a7c051f0-2768-47cf-ac62-8190efeac5c5","year":2014},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.031574Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:abb435b53a7d7ae9cf8ff56affe75d3d00dd0742e89cfb3f0385e6f216bfabbb","observation_id":"aab57915-c113-4d29-9737-247d937a7141","resolution":{"observed_at":"2026-08-14T14:08:04.091396Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.00374","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.505137Z","title":null,"venue":null,"work_id":"16ed67f8-9818-40d0-8e85-50e21a1ec0d6","year":2018},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.035700Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:281f87b780148b6c70b0be64d1471e59c954800c4f20ad81729b7047fd1de914","observation_id":"ec8d0b7e-9943-4f6c-8033-ad81d172633c","resolution":{"observed_at":"2026-08-14T14:08:04.510549Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11263-017-1033-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:04.072408Z","title":"Hauptmann","venue":null,"work_id":"e130ed33-7a99-4337-a7c8-f1477cdc39ff","year":2017},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:04.039563Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:d05593b4f5faa8866555d3c1744624f13dec4fdf6ebc800a0b9fbddaaacaaeee","observation_id":"0860e204-9fd7-407b-866f-3420e761f69c","resolution":{"observed_at":"2026-08-14T14:08:04.077817Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:08:03.901764Z","title":"https://doi.org/10.1109/CVPR.2015.7298682","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval","version":3},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-14T14:08:03.901764Z"},"links":{"citing_paper":"/paper/1908.03737"},"observation_digest":"sha256:5227541d714ab6d2a552a772f6b389f8fda828de9199aa04c503e39572d4893d","observation_id":"a6150a33-ac8a-4090-8db2-0b11fa231a98","resolution":{"observed_at":"2026-08-14T14:08:03.901764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1908.03737","last_updated":"2021-05-05T17:07:43Z","latest_version":3,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-16T02:25:15.919727Z","submitted_at":"2019-08-10T12:03:48Z","title":"Deep Triplet Neural Networks with Cluster-CCA for Audio-Visual Cross-modal Retrieval"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":5,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":34,"verified_exact":18,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:1908.03737."}