{"as_of":"2026-08-07T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e0496d903b20f39866c14def10163a8d05f2ee35d142b2608271e66c90bf6743","coverage":[{"denominator":111,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:38:07.718482Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.05037/citation-record","integrity":"/paper/2508.05037/integrity","json":"/paper/2508.05037/citation-record.json","paper":"/paper/2508.05037"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.258645Z","title":"Biased mixtures of experts: Enabling computer vision inference under data transfer limitations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.258645Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f1ed43c693e5eb19f28d42d32eaae070994dce4199388484996a56d6963ec09b","observation_id":"8204abaa-6405-437e-a190-095efe6b3b1a","resolution":{"observed_at":"2026-08-05T23:38:05.258645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.328686Z","title":"Network of experts for large-scale image categoriza- tion","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.328686Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:a521872562809b7295dd6544a5cc18123b20eb5b2ddcc80b48e5a063e8e7ad83","observation_id":"606366bc-3d8f-4816-8e01-4f5d770bc0a5","resolution":{"observed_at":"2026-08-05T23:38:05.328686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.369123Z","title":"Salient-to-broad transition for video person re- identification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.369123Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:a6c74a8372864a3d90b043704306799166d51ecbcef7a3baab272e4f3614c7d8","observation_id":"fc525811-d1b0-441f-a0fc-37f02075e742","resolution":{"observed_at":"2026-08-05T23:38:05.369123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.445352Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.445352Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:8ad607a842df3837d71bf05d01ed112eac4f2b7748dc0f6079b6ad8cfe0457a0","observation_id":"a11b4141-3544-48c6-86ef-2fd29edc71cb","resolution":{"observed_at":"2026-08-05T23:38:05.445352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.530298Z","title":"Lagrange motion analysis and view em- beddings for improved gait recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.530298Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:c17e05f960fa0f5a8e448ec0d50bf6cd57dd65374068361d527920ec7d0d32cb","observation_id":"c5dfb28d-c452-4460-812f-2ca5a84240af","resolution":{"observed_at":"2026-08-05T23:38:05.530298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.645238Z","title":"Gaitset: Regarding gait as a set for cross-view gait recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.645238Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:60544be261d57117a963c1b3e4b9d97998773d426ac899aa74e289fb4cbd1849","observation_id":"4f8a9913-2c9d-4c33-9b7e-c2ba27a0102d","resolution":{"observed_at":"2026-08-05T23:38:05.645238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.725908Z","title":"Gaitset: Cross-view gait recognition through utilizing gait as a deep set","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.725908Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:87b818b5e68223b7c50f08c1eb7822a60e534ab3f9cc74bf24fd07dbd43cb121","observation_id":"68322f50-2fa3-4548-9b1d-2e687ff659f2","resolution":{"observed_at":"2026-08-05T23:38:05.725908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.793214Z","title":"Learn- ing 3D shape feature for texture-insensitive person re- identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.793214Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:7225b9e89ed3c4f2cb812f029bc1034e253f384ba4b91b17cd4fce3812f50001","observation_id":"95872dda-7fce-43a2-8906-9fe2eec2ce0c","resolution":{"observed_at":"2026-08-05T23:38:05.793214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.879354Z","title":"Eve: Efficient vision-language pre-training with masked prediction and modality-aware moe","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.879354Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:ec4724a77b83cfc311b001d84fd331ca69ea40a8c1e54df589273b6ec60c663f","observation_id":"bc208e6a-53d9-4d27-9fd7-2b9ebe83fe60","resolution":{"observed_at":"2026-08-05T23:38:05.879354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.981516Z","title":"Adamv-moe: Adaptive multi-task vision mixture-of-experts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.981516Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e57ed32d09f5d62789a3e6193e7b382665522a78fd82691fe08257cd96f6ae8a","observation_id":"f5bf6ffc-00af-479d-9539-3cf5ed3076eb","resolution":{"observed_at":"2026-08-05T23:38:05.981516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.082609Z","title":"Video person re-identification by temporal residual learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.082609Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e330fd5dd6a4bc837d4e7af1a81838ef938ab4eca53cb7a4a91385223cfde383","observation_id":"5f068dad-0944-46b8-b96f-6936a6e2bd58","resolution":{"observed_at":"2026-08-05T23:38:06.082609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.130916Z","title":"Generalizable person re-identification with relevance-aware mixture of experts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.130916Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:089c9d23259915eab6e55388ddbf9065960d0986b48fde17c9b1ede702eade63","observation_id":"99c968c9-a01e-4bd9-8bf0-15b020d51f3b","resolution":{"observed_at":"2026-08-05T23:38:06.130916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.248054Z","title":"MEVID: Multi-view extended videos with identities for video person re-identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.248054Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e16e1a32518b0a2e2a39ae8caefbb97ed6ca44eca61431d44049944a18e5435d","observation_id":"19f43ae9-54e5-44d7-9dde-09e6ffe1403c","resolution":{"observed_at":"2026-08-05T23:38:06.248054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.326162Z","title":"Metagait: Learning to learn an omni sample adaptive representation for gait recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.326162Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:3db43be92fa861b9c3707fdf7baf1665c7fe4b4c19fc2c16b2d3c2b4ddb670dc","observation_id":"b84d15c5-3a77-46d3-8fc0-c834e55368f4","resolution":{"observed_at":"2026-08-05T23:38:06.326162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.423625Z","title":"Gaitgci: Generative counterfactual in- tervention for gait recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.423625Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1969a0c399bf4467681fd3b241810e831fe450e84ade311d1b17034d1160ef2a","observation_id":"6a6a85e5-f65d-4b53-96a4-d5ff2acd1bb5","resolution":{"observed_at":"2026-08-05T23:38:06.423625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.4314","last_updated":"2014-03-09T20:15:03Z","snapshot_observed_at":"2026-07-06T03:30:57.897408Z","submitted_at":"2013-12-16T11:15:10Z","title":"Learning Factored Representations in a Deep Mixture of Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.4314","snapshot_observed_at":"2026-08-05T23:38:06.473866Z","title":"Learning factored representations in a deep mixture of ex- perts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.473866Z"},"links":{"cited_paper":"/paper/1312.4314","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:7cf4b699c7c9df0976aa60253e531ec20f02e029d0e5203a89c8cbfa1b870ecf","observation_id":"912e0643-9f9a-4056-8898-383d2a2092db","resolution":{"observed_at":"2026-08-05T23:38:06.473866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.561440Z","title":"Video-based person re-identification with spatial and tem- poral memory networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.561440Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:32b335c7781e0e3f9df5f7273a152a413c266992858502aebe9846c9dd1fbf8b","observation_id":"481e9099-e284-4c89-a0d8-e3d3f8f0a847","resolution":{"observed_at":"2026-08-05T23:38:06.561440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.648105Z","title":"Gaitpart: Temporal part-based model for gait recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.648105Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:adefb82af4891e2f29aeb5e0a532d9a8624cc5ab82d89d8896747f317458e951","observation_id":"ea26c6b3-3b28-49cc-a72b-9cdb80777936","resolution":{"observed_at":"2026-08-05T23:38:06.648105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.759749Z","title":"Opengait: Revisiting gait recognition towards better practicality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.759749Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e704c1c0cca9d5b4dab3b94c9a5aded4a085c0f4bee4660e1496eb2453b7a9ed","observation_id":"0d6c0035-28d9-445a-a294-a376ae4c98c3","resolution":{"observed_at":"2026-08-05T23:38:06.759749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.802684Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.802684Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f06d9c2d08a88aea89f198ab13852421cdd64e7e7455a5c003083829627453da","observation_id":"4c1ed0ef-2f7e-41c9-adca-b107e49b717a","resolution":{"observed_at":"2026-08-05T23:38:06.802684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.921751Z","title":"Sta: Spatial-temporal attention for large-scale video-based person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.921751Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:18790daee6efa6aaef359c79fddf52128d62c2bfd9e66c9798e862127366c206","observation_id":"7c39652c-2954-4006-90b7-8915cf1b08c3","resolution":{"observed_at":"2026-08-05T23:38:06.921751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.078247Z","title":"Mutual mean-teaching: Pseudo label refinery for unsupervised do- main adaptation on person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.078247Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:c54bddcd41aa022648ed0919718ce43ef31823d0bbb2f9b4c5b5d56d3ac62f07","observation_id":"db7592ea-f2f7-4188-b891-7060396c27cf","resolution":{"observed_at":"2026-08-05T23:38:07.078247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.154502Z","title":"Self- paced contrastive learning with hybrid memory for domain adaptive object re-id","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.154502Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:9b14544679ba1a652e6d329296c66ffc7299de8f4913a42eacfe710ec2e6a155","observation_id":"c2a8c7bd-6732-497b-90d5-dc7d2feaef15","resolution":{"observed_at":"2026-08-05T23:38:07.154502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.265504Z","title":"Hard mixtures of experts for large scale weakly supervised vision","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.265504Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:2c3e2da7d7a33bcfa86d496ac661be7a6affc47a935d4ea0420f986e08f2ed46","observation_id":"e14c6fab-828b-4d2a-9695-c5950195adcd","resolution":{"observed_at":"2026-08-05T23:38:07.265504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.380068Z","title":"Appearance-preserving 3D convolution for video-based person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.380068Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d66373d7c52aa666e6a22fc253460b31f65c1d9ee4a129525d4e14684404828e","observation_id":"994442fc-f22e-449d-b7d6-935e81449977","resolution":{"observed_at":"2026-08-05T23:38:07.380068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.410203Z","title":"Clothes-changing person re-identification with RGB modality only","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.410203Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:86193283d33f8e6345f98c493a671baa72c39ed17bd0a7686a18ef34cc5b5d6a","observation_id":"3a18463e-0eec-4327-98ec-21ee945c74f1","resolution":{"observed_at":"2026-08-05T23:38:07.410203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.414072Z","title":"Motion feature aggregation for video-based person re-identification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.414072Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:72cec9b6d8a0494afbd994ca5a358cf29ac123633367a0144cbac7ba7fb4512f","observation_id":"5383c35d-631c-484c-8483-6a16a891a4f2","resolution":{"observed_at":"2026-08-05T23:38:07.414072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.419093Z","title":"Dense interaction learning for video-based person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.419093Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:21d977cac10b443e774f8b55ffd1f87ea3beb539a542807aa43a43d9cee5950f","observation_id":"4097406d-c998-4c9f-a9ef-04af14e02256","resolution":{"observed_at":"2026-08-05T23:38:07.419093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-04T09:19:45.912586Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-08-05T23:38:07.424070Z","title":"In defense of the triplet loss for person re-identification","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.424070Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1dcc2b7961c4b5413effb854fa8818b522b24737fc91e759f8e1a966531bb43b","observation_id":"f9e97fd7-7ef4-4b65-8dc0-cb217787d8ff","resolution":{"observed_at":"2026-08-05T23:38:07.424070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.428841Z","title":"Temporal complementary learning for video person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.428841Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:70fd6d40894a0a61357613047f67a2bfb0e7460cd1661a565c34667f6d7665b7","observation_id":"d0f0f743-061f-4de0-9bf9-481823e7f578","resolution":{"observed_at":"2026-08-05T23:38:07.428841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.432199Z","title":"Bicnet-tks: Learning efficient spatial- temporal representation for video person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.432199Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:12688dbaf9d835ca217e28c07ea6f3f3b62920676b5a511c3b46cfbb9a63aa8f","observation_id":"307a7d14-0f6e-48d6-b605-0fc3c1f387f5","resolution":{"observed_at":"2026-08-05T23:38:07.432199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.436111Z","title":"Gait lateral network: Learning discriminative and compact representations for gait recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.436111Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:07134ca0287a2e81ed7f372cf37ed071be7ef6059064278c831ba2e481f5ec6a","observation_id":"ce85e3c4-be56-4e1b-bb85-49e0b3e61f0b","resolution":{"observed_at":"2026-08-05T23:38:07.436111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.439662Z","title":"Celebrities-ReID: A benchmark for clothes variation in long-term person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.439662Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:6187c70525bc392257a3c099295f88cc7dbf8ab2dd0653de597c825f326acda9","observation_id":"d301e7c5-7219-4d78-967d-74b872380e4a","resolution":{"observed_at":"2026-08-05T23:38:07.439662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.442908Z","title":"Beyond scalar neuron: Adopting vector-neuron capsules for long-term person re- identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.442908Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:ef5acb2feecff7bb191364e9bdd9fb482aaf867b421a4ccfa0b4ca5b27117132","observation_id":"c753b079-7a34-4ba3-a3bf-573516699e5d","resolution":{"observed_at":"2026-08-05T23:38:07.442908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.446714Z","title":"Clothing status awareness for long-term person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.446714Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:367881b4e785a0b5c078039d9a333a7b671681b40d0114a25c9abd2d120ba4fe","observation_id":"4a0fa5d4-71d2-40ab-b9a4-d9268f24aad6","resolution":{"observed_at":"2026-08-05T23:38:07.446714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.450576Z","title":"3d local con- volutional neural networks for gait recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.450576Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:b4ef0d1667b030f31cefa10599a26ba57e6572cfff2b798ac0ba1f65763da679","observation_id":"3b571530-935f-48e5-b8d7-4ee54b4e08bb","resolution":{"observed_at":"2026-08-05T23:38:07.450576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.454550Z","title":"Adaptive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.454550Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:47d011b9b5fd3fac14c5c2e2fbe0c84d475bc28f879159a19846c06b7a107a20","observation_id":"1caaa997-06c1-4207-8202-fd7d61a2c62b","resolution":{"observed_at":"2026-08-05T23:38:07.454550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.458077Z","title":"Prox- yfusion: Face feature aggregation through sparse experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.458077Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:978588346cf31a6bd39761651240dcbf388bfd6420e1a3ff8c14c31c4428da20","observation_id":"8245fa80-0f83-478e-8e94-323232e4de7e","resolution":{"observed_at":"2026-08-05T23:38:07.458077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-07T13:04:50.040909Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T23:38:07.462229Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.462229Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:565abdc494139f0c6d76b2bd35b34f66ec41f955a770fea250849f7c11dad683","observation_id":"cb1e78a4-dc9d-4597-acfe-53943f6b1652","resolution":{"observed_at":"2026-08-05T23:38:07.462229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.466793Z","title":"Cloth-changing person re- identification from a single image with gait prediction and regularization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.466793Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:c4c677a3cd7534df814bcdedfcc1bbdece00c582b3303873320aa8319b400af2","observation_id":"6f4db0be-d31c-467e-969d-4cddaa7a3fd6","resolution":{"observed_at":"2026-08-05T23:38:07.466793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.470520Z","title":"Hierarchical mix- tures of experts and the em algorithm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.470520Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:a6462911d4529d65db39134bf7091e250a2fba62b78d08d0c61db35c01a9820c","observation_id":"35158efa-e802-463d-a767-60fa9c2ef4ce","resolution":{"observed_at":"2026-08-05T23:38:07.470520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.474660Z","title":"Feature disentanglement learning with switching and aggregation for video-based person re-identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.474660Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:05e3cad17fd075b0ba274fd37b5892a906a632cc959b7e940535ee621e93c3ee","observation_id":"e20c2cdf-c3a5-4527-8369-738efb9e07dd","resolution":{"observed_at":"2026-08-05T23:38:07.474660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.478112Z","title":"Keypoint relative position encoding for face recog- nition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.478112Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:aaabd6f1f8183ec79239732a161c1288585c2a6dac5858d0ecde4ff54455afa2","observation_id":"3ab06d59-59c1-49f0-a2e8-3d1e9140c58b","resolution":{"observed_at":"2026-08-05T23:38:07.478112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.481993Z","title":"Sapiensid: Foundation for human recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.481993Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:400719b8dd4b60b5ae716d470922a929f23dd58baa62d8cf1696e3295acf84d9","observation_id":"ef16fd3e-2ec0-4003-b0a9-4b81bae61b26","resolution":{"observed_at":"2026-08-05T23:38:07.481993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.485535Z","title":"Sparse upcy- cling: Training mixture-of-experts from dense checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.485535Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:0cd3e8f5075601ffab2d214407b3cda5c7e5175ab1ec90e1dea67b04b66e1003","observation_id":"bcd5376f-c7b4-4b9f-a81c-1b22b093b80f","resolution":{"observed_at":"2026-08-05T23:38:07.485535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.489458Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.489458Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:8f3b7c2b8605e0b175e12f50eac1c53a4656b723b3ab5dc9013716068a0d61f5","observation_id":"8dc8aad9-3a37-49d6-aaf5-c41487204d2e","resolution":{"observed_at":"2026-08-05T23:38:07.489458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.493138Z","title":"Global-local temporal representations for video per- son re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.493138Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:035a11adfb534cc555adc0263c31a0f6310deb7188c70f5c2b547a0493ffda32","observation_id":"140a7dba-e2cb-4993-8e3c-17bcfea90dda","resolution":{"observed_at":"2026-08-05T23:38:07.493138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.497488Z","title":"Multi- scale 3D convolution network for video based person re- identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.497488Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d52a4f6375db0b15aeb361cbe51e83e7c84e844af8ca2dbaacfaaae1951812af","observation_id":"60b5b3ae-b44e-4507-9e2b-d9ce3a0c3927","resolution":{"observed_at":"2026-08-05T23:38:07.497488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.502321Z","title":"Unsuper- vised person re-identification by deep learning tracklet as- sociation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.502321Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:63294e7ed7f099b5e8fb5ebd4623d0b7c9e99f14384056b03306e60d74bc2947","observation_id":"ea38b9e5-a5ae-442f-8fa9-83ef6a279754","resolution":{"observed_at":"2026-08-05T23:38:07.502321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.506363Z","title":"Unsuper- vised tracklet person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.506363Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:fb97d4fb8e2f9b444fb0f14e83a1d0c47dab60aad737dd0e42104ae192086fb4","observation_id":"8f014907-2f20-4e5e-9784-4b30e0afe803","resolution":{"observed_at":"2026-08-05T23:38:07.506363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.509775Z","title":"Merge, then compress: Demystify efficient SMoe with hints from its routing policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.509775Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:a1a155930022388ae1fa5fc8710326445e3c3ddcc1ca0393aa6ab90a65a88190","observation_id":"1a9d2412-4294-4022-94a6-56af3133f163","resolution":{"observed_at":"2026-08-05T23:38:07.509775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.515143Z","title":"Learn- ing shape representations for person re-identification under clothing change","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.515143Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f9284caefeb3b7bd64ea13485830cbd1a76c9435e08fc4c3b21e38150e77ffd6","observation_id":"535b7df7-361c-47f0-97a9-0cf4d6bfb88e","resolution":{"observed_at":"2026-08-05T23:38:07.515143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.518870Z","title":"Gaitedge: Beyond plain end-to-end gait recognition for better practicality","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.518870Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:8841fff8b7dd2df1fbacb259175e2bd2e3aad6000a721c373c8edf7dfb234087","observation_id":"a27cdb5f-a9a3-4640-b9f6-9f11912ade98","resolution":{"observed_at":"2026-08-05T23:38:07.518870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.522367Z","title":"Gaitmask: Mask- based model for gait recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.522367Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:413adbf140c5abee9173a38ff8ab24bc709512f4fec2cf78ccbbb9e472103b83","observation_id":"b213d030-a634-477b-a2db-3cacf33afef4","resolution":{"observed_at":"2026-08-05T23:38:07.522367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.528601Z","title":"Gait recognition via effective global-local feature representation and local temporal aggregation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.528601Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:91f5f9c500e36c618111c681b8f140fce5ba5a8346f7ac71e19bdc8d84872a78","observation_id":"837039f9-d0e4-46b1-9282-067a55d99e41","resolution":{"observed_at":"2026-08-05T23:38:07.528601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.532725Z","title":"A bottom-up clustering approach to unsupervised person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.532725Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:60e5fd842f6d62704c244f40f26e759cb02410ec09ae3cdb98499dae54d4b704","observation_id":"c4a7a218-127c-4fb9-943f-983c4036887f","resolution":{"observed_at":"2026-08-05T23:38:07.532725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.536217Z","title":"Frozen CLIP models are efficient video learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.536217Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d1f0a0b25f2ff3b842c36b1c478055bdeb732a98ad6bf5c6584d3c57662f6eae","observation_id":"0598ea20-9370-46cb-aed8-bb920c8541f7","resolution":{"observed_at":"2026-08-05T23:38:07.536217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.539586Z","title":"Learning clothing and pose invariant 3D shape rep- resentation for long-term person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.539586Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:02569dd458154f1cf112cc530265396d7131cda704c439de90a32866eee891b9","observation_id":"9ba0a31f-70a0-4810-ac74-5cd7a8e57e88","resolution":{"observed_at":"2026-08-05T23:38:07.539586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.543794Z","title":"Farsight: A physics-driven whole-body biometric system at large dis- tance and altitude","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.543794Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:99742f961fbaf42eae805a19884e6dd4719047d00c0381feb2388047a81a0f01","observation_id":"a82ba625-56e1-4fff-87c8-b4726a224921","resolution":{"observed_at":"2026-08-05T23:38:07.543794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.547605Z","title":"Distilling clip with dual guidance for learning discrimina- tive human body shape representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.547605Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:aa0db1817c226f8dbb2b76ea7b540728893795c48cc99342df6c9f1f9777dc2c","observation_id":"fc0d3751-f4ba-407f-8fe1-eb9c83e9ad25","resolution":{"observed_at":"2026-08-05T23:38:07.547605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04616","last_updated":"2025-05-07T17:58:25Z","snapshot_observed_at":"2026-07-06T21:20:26.707391Z","submitted_at":"2025-05-07T17:58:25Z","title":"Person Recognition at Altitude and Range: Fusion of Face, Body Shape and Gait","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04616","snapshot_observed_at":"2026-08-05T23:38:07.551370Z","title":"Person recogni- tion at altitude and range: Fusion of face, body shape and gait","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.551370Z"},"links":{"cited_paper":"/paper/2505.04616","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:3a7fcc27f31ae2ced6fee9dd7c148e208ebbe8bdfc1d8abacf2851bbdbe5eec7","observation_id":"d008672d-9369-4d3a-b1ea-d24bcbebd0c9","resolution":{"observed_at":"2026-08-05T23:38:07.551370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.555254Z","title":"Video-based person re-identification with accumulative motion context","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.555254Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:58f1724045c47c37f00e6d5ba73e57345bdf7c18490b7714c72bc8c1384a904e","observation_id":"070a02bc-3acc-4285-b103-c00db56b0377","resolution":{"observed_at":"2026-08-05T23:38:07.555254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.558865Z","title":"Watching you: Global-guided recip- rocal learning for video-based person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.558865Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e6fbcbfa409f08cb9298c96853184b5360734b4717ac925ff5af19e2e7ccf9a0","observation_id":"967c38ae-e84f-4923-840f-1e024dd42978","resolution":{"observed_at":"2026-08-05T23:38:07.558865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.561958Z","title":"Deeply coupled convolution–transformer with spatial– temporal complementary learning for video-based person re-identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.561958Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:937a1a56944f7443317be0761087d8c3f97566c93dde0a67bd3a63814331afa5","observation_id":"f0ccbb80-c864-43cd-97d7-983b72da6384","resolution":{"observed_at":"2026-08-05T23:38:07.561958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.567392Z","title":"Video-based person re-identification with long short-term representation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.567392Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:a236648252b8fdc6f1be612ba110935a1f07fb505c88ac5fd6301aa44c6acde7","observation_id":"dabb276d-25f1-495a-add2-6ba659adfd5f","resolution":{"observed_at":"2026-08-05T23:38:07.567392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.570696Z","title":"A video is worth three views: Trigeminal transformers for video-based per- son re-identification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.570696Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d9f34bb6e6e78f45f3b677910cd9e485d8646d4f9b0e12f3922c8a5fe6c96711","observation_id":"eefc551c-c160-4371-8a1d-7cd3b3c1b30d","resolution":{"observed_at":"2026-08-05T23:38:07.570696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.573849Z","title":"Spatial and temporal mutual promotion for video-based person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.573849Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:633ef460d77f41b946cbc0eb00bfce99a206123b5f2e303a644cb6e48f54347b","observation_id":"42973522-dc60-4b1f-9bf3-cd6680eddd4e","resolution":{"observed_at":"2026-08-05T23:38:07.573849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.577730Z","title":"Recurrent convolutional network for video-based person re-identification","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.577730Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1de85679bc507051e212a32ba180aa477c82b5db3ef0cfe79f2ed92db8b21e4a","observation_id":"2f5815e0-327d-49ca-99fc-0874099ef27f","resolution":{"observed_at":"2026-08-05T23:38:07.577730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:08.252033Z","title":"Boult, Anderson Rocha, Haidong Zhu, Zhao- heng Zheng, Ram Nevatia, Zaigham Randhawa, Sinan Sabri, and Gianfranco Doretto","venue":null,"work_id":"0899ee91-c7c2-4c36-81c0-aecaac6f60cf","year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.582848Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:fa08ece91fbe0a7bd9e4ca093a6db31061bafb2e34e656287ee2eae22a173e8d","observation_id":"da54670c-10af-49c2-8052-5f0420015f9a","resolution":{"observed_at":"2026-08-05T23:38:08.257456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.586095Z","title":"Temporal 3D shape modeling for video-based cloth- changing person re-identification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.586095Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:6826e427265cecc97afe7dc838f40ccb6b742e9fc812d2fc0e9110f175549213","observation_id":"162d6088-8303-4333-9ed5-09b93b1a30e0","resolution":{"observed_at":"2026-08-05T23:38:07.586095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.589725Z","title":"Wheeler, and Xi- aoming Liu","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.589725Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:093c33bca8214f40e5d1512ce0b329a61752b08dc781c67d57cf2e1c8b9039da","observation_id":"69afc1fe-0e68-43c8-be76-aad55812ff81","resolution":{"observed_at":"2026-08-05T23:38:07.589725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.593312Z","title":"Video person re-id: Fantastic techniques and where to find them (student abstract)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.593312Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:db5430c569c50128034d50cc2ddb3d8ef0b2ec5398d7cf3410dbe23ddc75c6c6","observation_id":"1ffeaa27-e7e9-461b-898a-7f6a453cf12d","resolution":{"observed_at":"2026-08-05T23:38:07.593312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.598264Z","title":"Using mixture of expert models to gain insights into semantic segmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.598264Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1da7929dae0f0ce701f3df8e8c67563ba7b8e05731b44adab96629db7ad38bbd","observation_id":"c09aa087-b379-48fa-9775-a479096f6f0d","resolution":{"observed_at":"2026-08-05T23:38:07.598264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.602126Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.602126Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:644de7c84009ad12a41c8ebb393c86198c798f91e7adc9bc34a3bd2ab273fafb","observation_id":"b0633d16-3662-4ff3-95ab-7621c5ad086f","resolution":{"observed_at":"2026-08-05T23:38:07.602126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.606009Z","title":"Scaling vision with sparse mix- ture of experts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.606009Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d7814df5be4ca728a21f606a3b93f325facb00d6ad598a53e51c69df9463c0ed","observation_id":"6b79f6f9-a4ef-4121-8948-40f80fb9acbc","resolution":{"observed_at":"2026-08-05T23:38:07.606009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.609966Z","title":"On the exploration of joint attribute learning for person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.609966Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:6fb2142320ba04d8bd660379ac4a2ca57819069f154fc8225cf07ec755ec86b8","observation_id":"daa1dec8-f03d-4081-b63c-b4e80783e8ec","resolution":{"observed_at":"2026-08-05T23:38:07.609966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.613390Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.613390Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f0e61a072370d7bfd3728d237d24f1f3c460460a51b2e4359d38e8ef2b6bf293","observation_id":"cad4bc14-8eff-49a0-afcb-375aa50226cf","resolution":{"observed_at":"2026-08-05T23:38:07.613390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.616857Z","title":"Lidargait: Benchmarking 3d gait recognition with point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.616857Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:373c64d8abf5377d8816fb2184f59d79ef402d9587b872e71b7c12b81e781076","observation_id":"921b2139-52c8-4aa9-9478-a2d278937ea4","resolution":{"observed_at":"2026-08-05T23:38:07.616857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.622247Z","title":"Large-scale spatio- temporal person re-identification: Algorithms and bench- mark","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.622247Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:acaf0d2a4bc251cb00c3b90a9e962bc4bb9d59834cf41aeaefb9203676c02ec0","observation_id":"72d0e4af-0c89-4a49-9085-b9b0c9dd68d3","resolution":{"observed_at":"2026-08-05T23:38:07.622247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.629250Z","title":"Open-set biometrics: Beyond good closed-set models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.629250Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:3cb674883c000f0468b2334957b93dd2037b8ca785a7127f06befad1e2fc96ca","observation_id":"5dec5b38-a968-4d89-bc20-ca5a6eac6a98","resolution":{"observed_at":"2026-08-05T23:38:07.629250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.634195Z","title":"Wheeler, and Xiaoming Liu","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.634195Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:6120c19caf1ccb110dba3af12858be6670c5e56226072378047571d3aa0aed6e","observation_id":"931e1cf6-96f1-4242-bd3a-371bcf5926c7","resolution":{"observed_at":"2026-08-05T23:38:07.634195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.638864Z","title":"When person re-identification meets changing clothes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.638864Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:3b78ec742947270903e8f8a337503eadb2d9aa6a731145935b07d2008189d434","observation_id":"d67ff114-83a6-4fae-9393-746ff52ef58d","resolution":{"observed_at":"2026-08-05T23:38:07.638864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.642552Z","title":"Transferable joint attribute-identity deep learning for unsu- pervised person re-identification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.642552Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:97d48b68afefcc4a3bbc955761f51dcd408920743833451aa9374f4977708664","observation_id":"42d1be09-bb19-46fb-990e-cb2f0760bdfa","resolution":{"observed_at":"2026-08-05T23:38:07.642552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.647388Z","title":"Dygait: Ex- ploiting dynamic representations for high-performance gait recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.647388Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:aec227552b5374d043873e52337bb27561bcaca3a81e0fd41e907c83f627729e","observation_id":"2720d884-4f3c-42a5-bd45-e31a0b0e51f3","resolution":{"observed_at":"2026-08-05T23:38:07.647388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.653459Z","title":"Non-local neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.653459Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:7fc05ac8619a4e6d8a46e32991603e5bd6b2ff9c909b524fa82a96c0a08ed085","observation_id":"3487116c-88de-48ee-8b54-42f7c46619f2","resolution":{"observed_at":"2026-08-05T23:38:07.653459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.658703Z","title":"Deep mixture of experts via shallow embedding","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.658703Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:517e3d02afcc4fcaee7b2be5181905c4e255d9e23b08a2958ea3cd8dc3dab18a","observation_id":"327fad78-a02c-4bd6-b653-0c56d4e725f0","resolution":{"observed_at":"2026-08-05T23:38:07.658703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.662186Z","title":"Multi-expert adversarial attack detection in person re-identification using context inconsis- tency","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.662186Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e6c82785975aff61b03388161d1c268f21419d43c3103a7384865ff1298c4567","observation_id":"c55df656-84cd-44a9-864e-71badccf36d9","resolution":{"observed_at":"2026-08-05T23:38:07.662186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.666137Z","title":"Pyramid spatial-temporal aggre- gation for video-based person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.666137Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:168c5a63da2da105251004b983ac5d15bcafa9986ec70b79b7cc4f514e02a3da","observation_id":"2dc78fa4-c267-42f9-995f-782ea41d8752","resolution":{"observed_at":"2026-08-05T23:38:07.666137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.670052Z","title":"Decoupled feature-based mixture of experts for multi- modal object re-identification","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.670052Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:a254cbb7f9be5047fe525639a3bc62f474719d8507c091636fc3f23d1deda641","observation_id":"9f22c3e3-5c1b-4022-94b4-bb9683b9ff91","resolution":{"observed_at":"2026-08-05T23:38:07.670052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.674124Z","title":"Cavit: Contextual alignment vision transformer for video object re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.674124Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:3d91f1d4ee200248230a59977d953a2ebfbf92945e2b474e19dcad42ce3a2c5c","observation_id":"b05ce1eb-f7f1-493b-818c-e9e029654d7d","resolution":{"observed_at":"2026-08-05T23:38:07.674124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.678133Z","title":"Adaptive graph representation learn- ing for video person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.678133Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d2a48351f427a3bcafdfffb9051d8eae033900ba9b1e057bd20c96a701045f07","observation_id":"f2cd0b97-a99d-4141-835e-c060ab497d14","resolution":{"observed_at":"2026-08-05T23:38:07.678133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.682127Z","title":"DeepChange: A large long-term person re-identification benchmark with clothes change","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.682127Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1163b3b32d7309ce7322c1797b5c2d4326cd533857c38af4eccc18bc6b298997","observation_id":"8573aa33-d323-4ca8-bba6-af2cbf75bf87","resolution":{"observed_at":"2026-08-05T23:38:07.682127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.686222Z","title":"Condconv: Conditionally parameterized convolu- tions for efficient inference","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.686222Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:42df52d9647c6881912aa0d652d4e49730b6a5fc446c31a3b63291b04f6457bc","observation_id":"b7b8ba61-b0ef-41e6-84d2-17ed0d1a92ed","resolution":{"observed_at":"2026-08-05T23:38:07.686222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.690136Z","title":"Spatial-temporal graph convolutional network for video-based person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.690136Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1e459ad058108e795eeb0293b14fadf2e2bff4cb33dcecd34fcd1ce757aa8734","observation_id":"4836c2db-fe88-4a71-9b38-bbac17ae7ef3","resolution":{"observed_at":"2026-08-05T23:38:07.690136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.694752Z","title":"Person re- identification by contour sketch under moderate clothing change","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.694752Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:eda9b2b841409112022b249abaff1661d6af00f2eedc3187ba3d8d1795235f0f","observation_id":"c04ae30e-ae01-4536-892f-42e2c81b36a5","resolution":{"observed_at":"2026-08-05T23:38:07.694752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.698817Z","title":"BigGait: Learning gait representation you want by large vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.698817Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:c5c2f8ab8082f9bdffc9c9201867ff888a3675bc46528e34fcbd941250abba75","observation_id":"3b27dca2-36c1-44ff-9c85-c75d9456a99e","resolution":{"observed_at":"2026-08-05T23:38:07.698817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.702804Z","title":"Shiftaddvit: Mixture of multiplication primitives towards efficient vision transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.702804Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:ba96241c07cba71fe13b65e1edb8a1c6ad26744386a4b31eadfda25d813654f5","observation_id":"8f356d0f-0995-4775-b88c-534c99f0bfc2","resolution":{"observed_at":"2026-08-05T23:38:07.702804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.708515Z","title":"Top- push video-based person re-identification","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.708515Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:20ddebe206ed55addfdee0b2fc52cc6955fa6b0acf1f2dbc1b67fe5c1bae24ab","observation_id":"8c138145-25aa-475a-b927-51cce6864964","resolution":{"observed_at":"2026-08-05T23:38:07.708515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.713957Z","title":"TF-CLIP: Learning text-free CLIP for video-based person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.713957Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:608ce51adef3ad597bcf118508b67d79f932f7bf21e8c6530609740411717ae1","observation_id":"ee260ba8-48ae-4d56-8e31-4812b7a29b03","resolution":{"observed_at":"2026-08-05T23:38:07.713957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.718482Z","title":"Unsupervised per- son re-identification by soft multilabel learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.718482Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:002e6d417dd75d760c6b74475be67d6dc6de11d8b330b6711a419dcea8948350","observation_id":"6c51e932-0123-4f9c-a682-44aba871046a","resolution":{"observed_at":"2026-08-05T23:38:07.718482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T23:38:01.673363Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":111},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 111 outbound references and 0 inbound Pith citation observations for arXiv:2508.05037."}