{"as_of":"2026-08-12T08:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa90c6ca02ab3d94e78abc2c704c5614fe28998b35f1b3a6a9fa13d45d003059","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:55:19.304016Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.09608/citation-record","integrity":"/paper/2501.09608/integrity","json":"/paper/2501.09608/citation-record.json","paper":"/paper/2501.09608"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.375375Z","title":"Deep canonical correlation analysis","venue":null,"work_id":"44079610-880c-454e-9c5f-d11cdd9ca4b8","year":2013},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:18.988911Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:94178cf8d5d0ac99a3da594a3194f42f21919970152d983fbe194ba196564d87","observation_id":"e2c537a4-9ef8-483d-b0cc-f245265115f6","resolution":{"observed_at":"2026-08-10T19:55:20.385563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.349936Z","title":"Canonical correlation analysis: An overview with application to learning methods","venue":null,"work_id":"1cd99a4c-bf75-48e6-a691-4c7159888205","year":2004},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:18.998679Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:2b273518990795d0dcc3b7c0fb552bb43fe53ab1f81f33174edac0b318c17790","observation_id":"63fda567-e534-443c-83e1-07ec892dbc10","resolution":{"observed_at":"2026-08-10T19:55:20.359224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.325651Z","title":"Born again neural networks","venue":null,"work_id":"d72c986e-eb13-4a74-8943-777404e24aa1","year":2018},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.008248Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:85a9890b6ab0d3fe2da027f5c3c8b6d344cddddd5fbe711b8cd538bf5d71b562","observation_id":"97223f59-16ad-4fde-9d0e-e9beb8423096","resolution":{"observed_at":"2026-08-10T19:55:20.335707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.018563Z","title":"Knowledge distillation: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.018563Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:4aac5d2a86ce15585ab380272b231a65cdc42a89ece71f6da2fad9cb0abbfe77","observation_id":"4e18c006-c89d-4fc8-94fe-249e194ffa92","resolution":{"observed_at":"2026-08-10T19:55:19.018563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.01851","last_updated":"2019-08-02T15:17:27Z","snapshot_observed_at":"2026-08-12T08:35:28.665244Z","submitted_at":"2019-08-02T15:17:27Z","title":"Self-Knowledge Distillation in Natural Language Processing","version":1},"cited_work":{"arxiv_id":"1908.01851","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.01851","snapshot_observed_at":"2026-08-10T19:55:19.662938Z","title":"Self-Knowledge Distillation in Natural Language Processing","venue":"cs.CL","work_id":"b914fadd-9f99-4cb9-8da2-5e7fda51f9bb","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.029364Z"},"links":{"cited_paper":"/paper/1908.01851","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:397a2f1b100e10c966251970a5e9e5b053c88d12e8760a79d4e522c03d7658e7","observation_id":"bb92b290-8b76-48c0-ae93-33978bd4e03f","resolution":{"observed_at":"2026-08-10T19:55:19.672289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-04T09:19:45.912586Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-08-10T19:55:19.038011Z","title":"In defense of the triplet loss for person re-identification","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.038011Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:21e12a8c9d372fb1c3d4b93b0decd18e32abe61080581590d41049c039df55da","observation_id":"220e4117-ef21-47fa-b32b-d0431c8312ec","resolution":{"observed_at":"2026-08-10T19:55:19.038011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-10T19:55:19.048097Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.048097Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:502acb3fde1ad116a96aa489fedb3e270d0f3921314e12444857124a67745617","observation_id":"7db9b5ad-5413-4d34-b8c3-e7d2ed785da4","resolution":{"observed_at":"2026-08-10T19:55:19.048097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.267774Z","title":"Deep metric learning using triplet network","venue":null,"work_id":"fc6ccf45-8f59-4153-9a89-2c0c609feb8d","year":2015},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.057231Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:9d006b592d2d31bb389104ce36fdffc165ded66883f9f16555f93b1a354ce70a","observation_id":"468dabb6-deb1-487a-989c-c0c96450da81","resolution":{"observed_at":"2026-08-10T19:55:20.282369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T19:55:19.064803Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.064803Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:e5fa87aca0836ab91ee3d99352e4e2d5fd7fb82afc208b6aa48470f39b4e0748","observation_id":"a4e3138b-eaf4-43ff-8bbf-52ae4c0fab9a","resolution":{"observed_at":"2026-08-10T19:55:19.064803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.241635Z","title":"Metric learning: A survey","venue":null,"work_id":"c3c94ba0-680e-466e-bbcd-ba43e6eb92ad","year":2013},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.072529Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:c44ff9311bf1d71c369a5d6781e49af6e9f69cbfc6cb2571ea6a79595820c37b","observation_id":"52405364-b5c6-43c3-8c13-7b78587c04d7","resolution":{"observed_at":"2026-08-10T19:55:20.248251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.219727Z","title":"Kernel and nonlinear canonical correlation analysis","venue":null,"work_id":"8cafbb12-2be6-42ba-adc6-8b78d3db33db","year":2000},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.085139Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:eb5f3bb42a7ae3fbffcdbf66cea7c516932a28807bd436300a93445c2acae040","observation_id":"dd5dcdd7-19ec-460c-9491-8b9a13926610","resolution":{"observed_at":"2026-08-10T19:55:20.226687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.192749Z","title":"Rank-based distance metric learning: An application to image retrieval","venue":null,"work_id":"b281b072-bcad-4a4c-ae70-a40e7887e806","year":2008},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.094147Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:e9d8c126e3b0d361115f28fc86c4e9a331762dc18430944783b22b52fe4c9761","observation_id":"97de3a4a-9b15-4cc0-90cc-44143d935278","resolution":{"observed_at":"2026-08-10T19:55:20.200639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.170260Z","title":"Neighborhood- adaptive structure augmented metric learning","venue":null,"work_id":"d8bc9784-7347-450b-82c5-603188c07d1e","year":2022},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.108742Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:c37ae48db6e4c89f57099f795552df946a0d010a8e38ae441ee33ec79be2bd71","observation_id":"a1bcabfd-d784-495b-a25d-36e7f3f6cacf","resolution":{"observed_at":"2026-08-10T19:55:20.177174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.151686Z","title":"Few sample knowledge distillation for efficient network compression","venue":null,"work_id":"f85db3da-b126-42a9-b551-e9477b9c02f8","year":2020},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.118752Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:3d6742a1b7d6175697b67453c03ed92b9ddb1a79b417bd0f90e88ab0257ca8a0","observation_id":"1f205c67-6e5e-49e4-b9eb-6840497ba280","resolution":{"observed_at":"2026-08-10T19:55:20.157700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.125715Z","title":"Similarity metric learning for a variable-kernel classifier","venue":null,"work_id":"f6a04310-3d5b-4726-901f-bd0a2f7c91ae","year":1995},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.129339Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:3da39969a28bfcf9d8174e38c6e5ae017ccca98cbd8c6fe25b6ddf992c8edf5d","observation_id":"1ecd7202-b29b-4fb3-b0ee-271c70267282","resolution":{"observed_at":"2026-08-10T19:55:20.135946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.103084Z","title":"Cluster canonical correlation analysis","venue":null,"work_id":"8e5606ac-e0fe-4371-a964-6ffb9a2acbb3","year":2014},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.138234Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:3142ed06937ec169b2375c1b57a5c412dd4b437455117172751014dfa095ac4c","observation_id":"8cfef9fa-7a77-4a6c-8ed5-3df583224125","resolution":{"observed_at":"2026-08-10T19:55:20.109416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-04T02:05:40.539691Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-10T19:55:19.153546Z","title":"An overview of gradient descent optimization algo- rithms","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.153546Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:9f42239a99ee817bd7333c5e1dffc9ffe7c7381fba5b206157a0f8555bb20756","observation_id":"a524e6c8-1f54-483a-afb9-4711bb84588f","resolution":{"observed_at":"2026-08-10T19:55:19.153546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.070039Z","title":"Audio-visual event localization in unconstrained videos","venue":null,"work_id":"c44461ca-5346-43cb-9945-4b17e6790505","year":2018},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.163899Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:9e990118e3d1dfe1a6dc46662972cdade6f147ae2d64b14f5def5f79d49c94b0","observation_id":"67b4981d-474e-4c00-b7c3-f3c345474d59","resolution":{"observed_at":"2026-08-10T19:55:20.080242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04990","last_updated":"2022-02-28T08:23:57Z","snapshot_observed_at":"2026-08-07T20:13:33.891939Z","submitted_at":"2021-06-09T11:20:03Z","title":"It Takes Two to Tango: Mixup for Deep Metric Learning","version":2},"cited_work":{"arxiv_id":"2106.04990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.04990","snapshot_observed_at":"2026-08-10T19:55:19.469629Z","title":"It Takes Two to Tango: Mixup for Deep Metric Learning","venue":"cs.LG","work_id":"fba7d2ae-abf6-4152-95cd-627e91ee1fa8","year":2021},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.172972Z"},"links":{"cited_paper":"/paper/2106.04990","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:231fd8b159b21b2a369c1fa9c77e4dfa17ddea742223bb3487ea7672134b13ee","observation_id":"931e2501-a918-40cb-8470-17c5315a5c7c","resolution":{"observed_at":"2026-08-10T19:55:19.480687Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.042396Z","title":"Hyperml: A boosting metric learning approach in hyperbolic space for recommender systems","venue":null,"work_id":"7754d4ea-2333-4d1f-bd8e-993e44e77467","year":2020},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.186273Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:6c14b445c237aaf714bb9f5169de2a0193b535a2d0115b82e39f848ceba2a3cf","observation_id":"c3f74c22-8b68-4b29-b7ca-fffbe200f037","resolution":{"observed_at":"2026-08-10T19:55:20.050267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:20.015554Z","title":"Videoadviser: Video knowledge distillation for multimodal transfer learning","venue":null,"work_id":"7f7a1e4b-cd99-4b17-ac21-0c246f290105","year":2023},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.196768Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:afc702af6baf04e16cfe7a7f2fb2f5afc115ff9c8707b383d941d0df7b6b57c6","observation_id":"2153e4e9-cc07-4f73-8c77-5d6a5311c1ce","resolution":{"observed_at":"2026-08-10T19:55:20.024152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.982534Z","title":"Distance metric learning for large margin nearest neighbor classification","venue":null,"work_id":"262bb9db-4b26-400c-b567-196a226fadb1","year":2005},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.206931Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:f346b6e4c2f0442971c4504326103501facd59816f117e32c1b487a6bff003aa","observation_id":"071e1327-fccb-4660-8e22-42b9643789c3","resolution":{"observed_at":"2026-08-10T19:55:19.990651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.957462Z","title":"Distance metric learning with application to clustering with side-information","venue":null,"work_id":"bdc9f22a-277a-43ce-a4ef-be7875dea996","year":2002},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.218482Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:aaded2d32faa2d6070fa6518a93057f75d62db15e6d1b39fa275c327c57d75f1","observation_id":"b7396da3-3a67-4f16-9d0e-0eca9fcad1ad","resolution":{"observed_at":"2026-08-10T19:55:19.964764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.934796Z","title":"Category- based deep cca for fine-grained venue discovery from multimodal data","venue":null,"work_id":"c6a8de63-dd13-42d6-a2b5-cf3f4d09bff6","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.227384Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:dbdc1c44af66b024b63802e9c6b834f51b09a5f7b940aa01ca932fddb7f0d4d1","observation_id":"59654b1a-bf45-410c-af80-2b14a22b378e","resolution":{"observed_at":"2026-08-10T19:55:19.942559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13451","last_updated":"2023-10-20T12:35:54Z","snapshot_observed_at":"2026-07-06T16:36:07.860946Z","submitted_at":"2023-10-20T12:35:54Z","title":"Two-Stage Triplet Loss Training with Curriculum Augmentation for Audio-Visual Retrieval","version":1},"cited_work":{"arxiv_id":"2310.13451","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.13451","snapshot_observed_at":"2026-08-10T19:55:19.417492Z","title":"Two-Stage Triplet Loss Training with Curriculum Augmentation for Audio-Visual Retrieval","venue":"cs.SD","work_id":"1ea2fe47-0200-457a-9479-d749ef43ae8b","year":2023},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.235378Z"},"links":{"cited_paper":"/paper/2310.13451","citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:7c86c234055d047618df9e081dbd74edc63d7203361c6c2e17c89e04a1c30311","observation_id":"69343916-7c7b-4853-af57-c96e97d56012","resolution":{"observed_at":"2026-08-10T19:55:19.430873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.900816Z","title":"Learning joint embedding for cross- modal retrieval","venue":null,"work_id":"af3b9be8-f8bd-4259-8ad2-f9f0b117dfe0","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.248061Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:60b16979ad9b5379f22726793640da2e3a0b38abd53a19deef700352c49e4c85","observation_id":"4303dd6c-2831-44c2-afbd-7236e953592e","resolution":{"observed_at":"2026-08-10T19:55:19.916795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.874009Z","title":"Anchor-aware deep metric learning for audio-visual retrieval","venue":null,"work_id":"abb132a3-2a65-403d-803c-670076f2bc75","year":2024},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.254015Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:66d2cde3f9ad387ffc04c7c54ae61dcdbd36987a0dc8dc53f9379f3c78d4ea3e","observation_id":"658652fd-4a10-47e7-bc35-16b9a1280e1c","resolution":{"observed_at":"2026-08-10T19:55:19.882985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.841567Z","title":"Com- plete cross-triplet loss in label space for audio-visual cross-modal retrieval","venue":null,"work_id":"d23c3d2d-579e-4010-9f23-11a838e660e4","year":2022},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.262167Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:7868d788bbee11d8f122fee5de37d348387d428b24ae7d39fae3b666ab84c9b6","observation_id":"a1b34f4f-a4cd-40f3-af97-317b46214b77","resolution":{"observed_at":"2026-08-10T19:55:19.850295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.814618Z","title":"Learning explicit and implicit dual common subspaces for audio-visual cross-modal retrieval","venue":null,"work_id":"f37026ae-6388-48b6-8473-4efb69468d39","year":2023},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.276450Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:91e47b7941d8e106ffc0edc33bca24b28abffff6ade2d81945fa65a7bb526722","observation_id":"133978f8-9ebb-4acd-9229-d8a4587e3b68","resolution":{"observed_at":"2026-08-10T19:55:19.824376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.785500Z","title":"Deep triplet neural networks with cluster-cca for audio-visual cross-modal retrieval","venue":null,"work_id":"433fc633-7ba7-4a2e-95e6-d824bab3392d","year":2020},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.286959Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:d7fc0488c15d27bdfed122030f26dd3f76e780a93d0c76eedc4a5387acfc5cab","observation_id":"24425459-3384-4e2a-a149-56d489706d1a","resolution":{"observed_at":"2026-08-10T19:55:19.795762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.738154Z","title":"Hardness- aware deep metric learning","venue":null,"work_id":"93b208d0-a887-4081-9758-f1545c353e48","year":2019},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.293704Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:deffcbaf43cd1d144c1b8913de3ba977577fd5da22b8995e1a9dae0fb80df784","observation_id":"b2f7348d-2483-4311-9ec0-c150a7774176","resolution":{"observed_at":"2026-08-10T19:55:19.747768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:19.700788Z","title":null,"venue":null,"work_id":"a39839da-13d0-412a-978c-299e45f4024e","year":2018},"citing_paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:19.304016Z"},"links":{"citing_paper":"/paper/2501.09608"},"observation_digest":"sha256:c585443229df0e8d166600d1c6d741e2ab3e3689c37e0cb4d55b7cff04b75422","observation_id":"2dcb09a9-9e1b-4e92-bc63-a56b207dda88","resolution":{"observed_at":"2026-08-10T19:55:19.712948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.09608","last_updated":"2025-01-16T15:32:41Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-12T07:43:24.320466Z","submitted_at":"2025-01-16T15:32:41Z","title":"Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":3,"verified_fuzzy":23},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2501.09608."}