{"as_of":"2026-08-14T08:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26f28d9db0f0a03a8beb82fa2a1ffcca6110ff71f26cf0d1495c0dbb30f00188","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:51:44.999434Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T03:33:57.334363Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23365","snapshot_observed_at":"2026-08-02T03:33:57.334363Z","title":"MCFNet: A multimodal collaborative fusion network for fine-grained semantic classification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16327","last_updated":"2026-07-15T14:06:17Z","snapshot_observed_at":"2026-08-13T20:10:23.989870Z","submitted_at":"2026-07-15T14:06:17Z","title":"Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T03:33:57.334363Z"},"links":{"cited_paper":"/paper/2505.23365","citing_paper":"/paper/2607.16327"},"observation_digest":"sha256:4a028fdaed8b80b474d915b44e77c45d15db197767b0b09422422a5ee0e98a0b","observation_id":"523a052e-91f2-4382-b937-9961366a4c32","resolution":{"observed_at":"2026-08-02T03:33:57.334363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23365/citation-record","integrity":"/paper/2505.23365/integrity","json":"/paper/2505.23365/citation-record.json","paper":"/paper/2505.23365"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.660542Z","title":"Tuia , author B","venue":null,"work_id":"bca52fe0-deba-4405-a8d3-4ff82795a796","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.382845Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:4d69dce50feac1eeea254a96b5ab095b203e9e4878d9c3ec1e2a5c3ba9a6d3e1","observation_id":"5f3562d6-c148-4b9b-8efc-d9109c0587a1","resolution":{"observed_at":"2026-08-07T12:51:56.745814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.518687Z","title":"Fu , author A","venue":null,"work_id":"4856b65c-fa22-4d03-bf74-24d754ac0ea2","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.473784Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d284b1306b0057716f42e5a93e3c4816442939d19d812c14f3f97026d8a6a08d","observation_id":"c413af52-a73e-4e38-a25d-0dfab3a3715a","resolution":{"observed_at":"2026-08-07T12:51:56.581762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.312863Z","title":"Rubin , author O","venue":null,"work_id":"b1c70396-8821-4760-b2ff-9d5411c515e3","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.604738Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:a063a201e20872532cccb16c666b51b3e264432a02bc2c79f500d3dec5386841","observation_id":"b65098a0-e40b-4606-9340-dac4b2143bd5","resolution":{"observed_at":"2026-08-07T12:51:56.400322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.186061Z","title":null,"venue":null,"work_id":"6f861f99-4bd9-4bde-a48d-4a653dc183e5","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.782627Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d57ee41cb23f88035de5307c2e05ecea4cbe1ba10b3afce838c6a48856d278c1","observation_id":"c73256aa-34b7-45bc-9bad-239cb60c4592","resolution":{"observed_at":"2026-08-07T12:51:56.235356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.007433Z","title":"Prakash , author K","venue":null,"work_id":"7acb861a-2e87-4505-bd07-483f25836768","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.952498Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:5f68fee24017e18c5837cadc5a809c3a26861991f39f347d9774c588a693bf08","observation_id":"cd63dd5b-2c4d-455f-81a7-851f5c28b2f6","resolution":{"observed_at":"2026-08-07T12:51:56.095660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.850272Z","title":"Xu , author Y","venue":null,"work_id":"f75a3ca7-e566-49c7-8ab1-8a2ebac17c2e","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.087761Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:51bdde36b1b8d288a62b59931a85085b870738e3c0d05292b504c1fac69dc448","observation_id":"24713c7e-8cc5-491a-a94f-1d168d3c2854","resolution":{"observed_at":"2026-08-07T12:51:55.928765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.625163Z","title":null,"venue":null,"work_id":"ecdc36df-5773-4d8d-83c6-60fd14d6cd17","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.239526Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:43699465059ae01363132f29bb3c778fcb993bc273221c5b1b161398fd941b88","observation_id":"9617db87-240d-4a6f-ac0a-1c5e60d01ee4","resolution":{"observed_at":"2026-08-07T12:51:55.744482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.433225Z","title":null,"venue":null,"work_id":"0a68f716-b35a-4ecc-a727-845718b23bf4","year":2004},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.415984Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:73ed9bb5b28f0833478614f9af3af58ee04b6d785bccd4a64d29748d8b670b4f","observation_id":"9a72dca9-d13d-487b-860c-8f64445b604b","resolution":{"observed_at":"2026-08-07T12:51:55.523200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.240393Z","title":"He , author J","venue":null,"work_id":"e033a40f-7fe8-4888-acc1-e34ab1af5c78","year":2008},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.539554Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:8a61ff0f312c709a3dc5aa512506125221c5fa01f1844253ef8c108d05bf4211","observation_id":"cbc73eba-7667-49df-befb-8766e1d18259","resolution":{"observed_at":"2026-08-07T12:51:55.330833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.053863Z","title":"Xu , author X","venue":null,"work_id":"d75f7b51-5a76-4086-bbd4-d8b1d51f8b1f","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.680222Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c9a344bdb1e0bbef98acc411a3068566926af5003de84db4a6f21f1a9f0cdaf8","observation_id":"e569d3a0-9135-4907-808f-00f851860d64","resolution":{"observed_at":"2026-08-07T12:51:55.142068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.865552Z","title":"Li , author M","venue":null,"work_id":"492b0b37-6dbd-4a6a-8b17-b4133ae6330c","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.787387Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:a032377532a053673544a44593587228f3de94cc6168b287cb1ae3eee1763dd3","observation_id":"f4a117e7-fee4-4d99-bbf3-4690db3a07aa","resolution":{"observed_at":"2026-08-07T12:51:54.948483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.632753Z","title":null,"venue":null,"work_id":"ae1ee38c-d0ea-44bf-95ef-73f01afd0d0a","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.893776Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:6ef96769e71df6b02cba317736cef352f13dd262465c30513a783b35c56bb99a","observation_id":"900cce49-3eb4-47a3-b666-84ef6c49c78e","resolution":{"observed_at":"2026-08-07T12:51:54.739704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.388702Z","title":"Huang , author S","venue":null,"work_id":"28e2f05d-86ee-4a26-a051-91b7869f802f","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.992768Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:0057a7094bf86d83aaec1275fc651785c5313416d4c6f7e9642ad81d1a173ace","observation_id":"f02fadbc-1019-4788-972d-8b183b4440d1","resolution":{"observed_at":"2026-08-07T12:51:54.530143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.203835Z","title":"Zhou , author G","venue":null,"work_id":"e8108386-c472-4418-99de-0b52ee6ffe19","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.097547Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d8fc099ba75a97478609100305777540f2602b193e466a17443fbb1058bd78cf","observation_id":"88fa1da3-25cf-4557-849b-c0ba7f850b4a","resolution":{"observed_at":"2026-08-07T12:51:54.278618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.971105Z","title":"Huang , author Z","venue":null,"work_id":"e4711cc5-4598-4516-99dc-59392e51c2eb","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.178292Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:53660c1e0fab50f1ce4b851393eb737b50213466e5f79c73032bbc05e60a161e","observation_id":"217e6e0c-7173-4f64-925a-ebd976923d03","resolution":{"observed_at":"2026-08-07T12:51:54.082892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.757226Z","title":null,"venue":null,"work_id":"a6edb65d-5ee5-4cdf-8d1f-bab847fd5ec4","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.265989Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:96e8498a96d03c60d4904d19d251f497afeec670a1393c32754209b72cfccb2a","observation_id":"66badfa4-9860-46e9-a1da-62cf3d8cc8ad","resolution":{"observed_at":"2026-08-07T12:51:53.857281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.499644Z","title":null,"venue":null,"work_id":"6e34b19b-d244-4581-91b3-76a2ff233a80","year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.338258Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:a4e7f933a51d45f61267384f86c531e6734320b3e94ef4d40b4c507a5e848394","observation_id":"aabeab9f-7129-46a1-9c48-3ad2b875da01","resolution":{"observed_at":"2026-08-07T12:51:53.601849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.306318Z","title":null,"venue":null,"work_id":"b22ddbb4-cb0a-4772-a1a1-49bd036d505b","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.433625Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:09845e11873b535f8fc098705a78439d658de5e8dff8ce85bfcf476af8935cd6","observation_id":"d24ae614-4ddf-4257-b8ad-8c4e92781aff","resolution":{"observed_at":"2026-08-07T12:51:53.412085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.034447Z","title":"Sun , author Y","venue":null,"work_id":"addaf72a-e7b4-4e1b-9ac0-1eed2c7839d9","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.544749Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:8cc8e484bbcecc1b0622103679646868c3e15e24833b23537e78003d6084c7bb","observation_id":"6abbc151-9740-4e75-a619-c53cbcebfac0","resolution":{"observed_at":"2026-08-07T12:51:53.142624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.831566Z","title":null,"venue":null,"work_id":"6da3aef0-bcbb-42db-8db1-2fd7a1e80f75","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.606759Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:7e3eec811bb350ffa3a845b1aed0a05fdcf8dc06ed861720a21f9b98693fd69d","observation_id":"20a00d9b-a07e-4c38-be05-dc549b97d9c5","resolution":{"observed_at":"2026-08-07T12:51:52.919209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.642896Z","title":null,"venue":null,"work_id":"3ca2b3cb-1a09-40bf-b303-048edd93a172","year":2015},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.680364Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:4b983b54ada301420061d3ba8a3d0bf6186fb2a89116743e118a3dfc6f5b1542","observation_id":"226a53c3-e7cc-434a-8906-557fc7a92ced","resolution":{"observed_at":"2026-08-07T12:51:52.747306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.439493Z","title":"Gao , author O","venue":null,"work_id":"e3091ad3-bd57-41d7-a93e-a8e561aba63a","year":2016},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.746641Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:f114f242b73afbfbafbf0a53c1da26ba444b9e3bec2a384a35ed964d9683c3c9","observation_id":"2f06e7c3-c11c-45e5-8503-7dc112a2a099","resolution":{"observed_at":"2026-08-07T12:51:52.516909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.240970Z","title":"Kong , author C","venue":null,"work_id":"87325d38-b2a9-4c15-9073-25a424cd1f3b","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.840466Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:e815c05f029fd750fd22a1f5b37c9a350a407ba3a447a9d47fd5bd88205fa42d","observation_id":"797f9875-6655-49b9-bc40-3ce53ed9551b","resolution":{"observed_at":"2026-08-07T12:51:52.350023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.014781Z","title":"Cui , author F","venue":null,"work_id":"54e6deb0-b101-4137-aab5-1f4ad2051837","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.915892Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:28c09046da68c342eb4f9f0993b65d57696653056bd5f1d8496bd68bf3470dbd","observation_id":"448e3641-290a-4aed-bac0-0a121380cb90","resolution":{"observed_at":"2026-08-07T12:51:52.109654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.806758Z","title":null,"venue":null,"work_id":"a7afbfc4-4a70-4010-b08d-cd994c3a84ee","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.994617Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:e9f5281b44de8e7ccf8a31ab9d3185b439b7e1e19aa5d2ae2d5830d4b79bdd94","observation_id":"a1de50f9-dece-4b48-87c9-e75c40143bff","resolution":{"observed_at":"2026-08-07T12:51:51.887698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.608733Z","title":null,"venue":null,"work_id":"d71a99fa-2f89-4ef7-a921-d7c76bae5850","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.063857Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:24cba053ece20741fef0ee93cbce1baacf7f3dcecbcc912d411b267f16447dd9","observation_id":"c1cb6817-2f85-48f3-9991-4447405e33bb","resolution":{"observed_at":"2026-08-07T12:51:51.724283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13176","last_updated":"2025-09-08T12:05:58Z","snapshot_observed_at":"2026-08-13T21:22:52.504881Z","submitted_at":"2025-04-17T17:59:47Z","title":"IMAGGarment: Fine-Grained Garment Generation for Controllable Fashion Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13176","snapshot_observed_at":"2026-08-07T12:51:41.175305Z","title":"Shen , author J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.175305Z"},"links":{"cited_paper":"/paper/2504.13176","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:1554345ea6addd02e97294da637c82ea8074cc8bbf3559561527930b45b70070","observation_id":"c42fa6c2-776f-4a11-9f81-f9ae0f18b413","resolution":{"observed_at":"2026-08-07T12:51:41.175305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.414023Z","title":"Dosovitskiy , author L","venue":null,"work_id":"d01e003b-7369-4318-9412-d4ba1a879237","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.272079Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:1f1ef323d25f3c5bc98fff61dc20f596ac3607ac1f8d3de37e08d35099479ed9","observation_id":"ca487f4f-24bb-4e80-a52b-a4bf3c0f196f","resolution":{"observed_at":"2026-08-07T12:51:51.514506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.114771Z","title":"Liu , author Y","venue":null,"work_id":"d1d62862-0299-463d-ac29-270297266902","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.384136Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:b9b7a76279a8e16ef151ba87f8126346608b33c44d006089a990784c2470711b","observation_id":"98e807a5-7758-4132-a9c3-24b33b974458","resolution":{"observed_at":"2026-08-07T12:51:51.232037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.883003Z","title":"He , author J","venue":null,"work_id":"09b9623d-1c1f-4fec-855b-1241c8714c8a","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.477463Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:bd82a7baf8031eb3a15e4b1b5ce1fd17af28f23c9ac3974304811fdfd024a763","observation_id":"4106d4fd-f164-486e-a65f-937dc8806137","resolution":{"observed_at":"2026-08-07T12:51:50.965667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.721544Z","title":null,"venue":null,"work_id":"8f2cde69-75b9-412d-abfd-4cf9655d24b6","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.571402Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:f87b39b51e4f04dbbdc791d030303e01e6475ee1224c7d35d8dd4898221ff359","observation_id":"cdf776c8-9329-4876-a11c-e5dd8845f362","resolution":{"observed_at":"2026-08-07T12:51:50.803101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.561550Z","title":null,"venue":null,"work_id":"c9ac73e9-3eb9-4e8f-81fe-86b7450bfed0","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.747076Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:96487db0a00ec8357cfd5d0b00cf601467bacf8268423227ac4c51dc20ad3520","observation_id":"fe79565d-e4bf-46a9-a0bc-9d25e81b1594","resolution":{"observed_at":"2026-08-07T12:51:50.612309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.320393Z","title":"Shen , author J","venue":null,"work_id":"65c6aa65-fa74-4ad2-826c-b165cb0fcbff","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.820686Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:44303ba29391ff2f59bb9733b406fe8660df3c3a82ba493ae57c7244280117c7","observation_id":"3c9f8722-9253-4b69-ae7c-86eb97dee8cd","resolution":{"observed_at":"2026-08-07T12:51:50.437141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.092218Z","title":null,"venue":null,"work_id":"5cbe3b36-a565-4c2c-9ae1-239a56d4036a","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.890697Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:11a3f895c45ba8920d6aca97b770d0f492d982869078b20df0767ec3e6c07c51","observation_id":"3ca8e372-8763-4191-93b1-d9f0a9cd2086","resolution":{"observed_at":"2026-08-07T12:51:50.215958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.845954Z","title":"Wang , author J","venue":null,"work_id":"0617f918-f005-408d-bad8-4f56c7db944e","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.985294Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:69cabbe8a5510d62c9e96b38db5a1268f44dd2b88bdc1ac4ae39441d742933c9","observation_id":"8bd2d9a1-7301-466e-bbb0-abd5f802a213","resolution":{"observed_at":"2026-08-07T12:51:49.958392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.642650Z","title":"Jiang , author M","venue":null,"work_id":"7db822d1-cf3f-421e-ae27-303cc7279cee","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.096292Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:a1747f5a6e9d18a67fa1bfd240678b41ef95f8ab4107ff86fb98bfdfe2d5de92","observation_id":"c6605c02-9e5b-406f-85ff-3bd42048b2b1","resolution":{"observed_at":"2026-08-07T12:51:49.745036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.419498Z","title":null,"venue":null,"work_id":"2190baea-f64c-4c71-9085-465fa21c2d8e","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.169987Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:83ac06298e249f790af17d0c41c52d43165c35b73fb021bca352e0bdbe4d88f0","observation_id":"efc18924-5c7e-4530-a01a-c2f0639fdc3e","resolution":{"observed_at":"2026-08-07T12:51:49.522450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15140","last_updated":"2025-03-30T13:12:34Z","snapshot_observed_at":"2026-08-10T14:32:57.416372Z","submitted_at":"2025-01-25T08:52:43Z","title":"Analyzing and Boosting the Power of Fine-Grained Visual Recognition for Multi-modal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15140","snapshot_observed_at":"2026-08-07T12:51:42.318376Z","title":"He , author G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.318376Z"},"links":{"cited_paper":"/paper/2501.15140","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:5e1c1e2071db56ce5218781571500c33a3ce211524aacb933e1801e386f76ffd","observation_id":"19fea118-45d9-4fe5-9c13-0b0e861f7fef","resolution":{"observed_at":"2026-08-07T12:51:42.318376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.161638Z","title":"Shen , author X","venue":null,"work_id":"86516345-abbc-4039-ba2b-6160e848a9f2","year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.402329Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:b4ca93aaf5378865b8966e4959f130fd2bbf5c6616c557f0d1ce73c109e31202","observation_id":"df5576b9-98e7-44db-9cb6-28e1d01c911b","resolution":{"observed_at":"2026-08-07T12:51:49.302322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-10T12:41:22.906234Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T12:51:42.530709Z","title":"Shen , author C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.530709Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:60a302ba32b0c7f659ddf065129855d9fa84debee06dc17eb4c3cc1f6ca25138","observation_id":"c5f665c0-e78c-4f46-91ee-eb4b089377e3","resolution":{"observed_at":"2026-08-07T12:51:42.530709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.975393Z","title":"Shen , author H","venue":null,"work_id":"6cae3f2c-d656-4a0e-8615-d7af7a281fd3","year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.625596Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:76fd73b6efe08676af64343926eb21d937054856ff48414a0d89f3864fdd308b","observation_id":"1e5fdad1-f810-46cf-87bb-3e03005a0f68","resolution":{"observed_at":"2026-08-07T12:51:49.061861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06313","last_updated":"2024-11-21T12:06:59Z","snapshot_observed_at":"2026-08-13T05:53:21.154401Z","submitted_at":"2023-10-10T05:13:17Z","title":"Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06313","snapshot_observed_at":"2026-08-07T12:51:42.702251Z","title":"Shen , author H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.702251Z"},"links":{"cited_paper":"/paper/2310.06313","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:ae7de9bbae1fde059f0c097c95e7eed92a05c6d51ddafff3d3532979a3a112e8","observation_id":"3a4149ff-8cf7-4d1c-9d1f-c12cc95e7970","resolution":{"observed_at":"2026-08-07T12:51:42.702251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.714276Z","title":null,"venue":null,"work_id":"61e69112-e45f-4512-9c28-b8f1b0aa399c","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.820361Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:4d229f97c3dc9ad6af7f13fb61843d83c80c06470a86d04f2b17d09d3a1bed3f","observation_id":"59951c63-5b10-49da-bb61-93aaab916198","resolution":{"observed_at":"2026-08-07T12:51:48.832738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.491557Z","title":null,"venue":null,"work_id":"3db5ab1a-074e-4742-8a88-89acb072d1a4","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.913397Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:1c060cd553ebde8434da30e5906ece0236b415ea0c3b619071af8fe7bf81cbec","observation_id":"c82361c6-6e8e-46f8-bf1c-b1265b8ab8e4","resolution":{"observed_at":"2026-08-07T12:51:48.587217Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.257738Z","title":"Karaoglu , author R","venue":null,"work_id":"00bdbb2c-8012-44fe-87c4-6dff19f87242","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.025872Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:cc5c1ffc9cd0d3c5531d752f525a162f765788d3cf21afef0f9c17f30c0beaf7","observation_id":"395d6eb2-58e6-4156-8e66-f49403b29126","resolution":{"observed_at":"2026-08-07T12:51:48.361725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.022161Z","title":"Bai , author M","venue":null,"work_id":"81a08ecc-157b-4309-8b2e-dbbe778a4377","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.200716Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d9f73e306d6d6d10294cf97919209a9d87388e5059d99da74abc8707ae2a8900","observation_id":"43a71217-79f7-485e-94ff-e9eaf93ae837","resolution":{"observed_at":"2026-08-07T12:51:48.138148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.808981Z","title":"Howard , author S","venue":null,"work_id":"75197e0f-9049-4224-8b72-ccf4defcbd18","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.391835Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:05ca4b7702c103e3d59d38d422fa4fd6114f9958ec432c8f88e1b7ddf5bd0051","observation_id":"cb608dc9-c4e6-4213-9977-44bafd01cf33","resolution":{"observed_at":"2026-08-07T12:51:47.919151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.571500Z","title":null,"venue":null,"work_id":"b9bea126-eab2-4f1b-be2c-b9b4bcb48173","year":2016},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.574843Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c1f6e81a4c1baa840079bd8a1ccc97a22b1cd055aedc8a107f8653364a5a2230","observation_id":"a39b8cf6-5577-4072-9e5a-41df8e4978d3","resolution":{"observed_at":"2026-08-07T12:51:47.674127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.363396Z","title":"Pi , author W","venue":null,"work_id":"8d45f189-f0f3-4861-8bc2-71874ec3d940","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.703366Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:29acfd92903db76d5f11c9598392acdb461bb7e836dab898f116997af43858fa","observation_id":"bc111156-dbd4-4259-9676-c51f3bc2bb00","resolution":{"observed_at":"2026-08-07T12:51:47.483249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.143964Z","title":null,"venue":null,"work_id":"bd1f40ea-0574-43f9-b79f-a4776c178e79","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.813455Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:96675765b42bfe6349adc19023e6f9b25315f159c0a32a6c2fc2e441fd6f3c88","observation_id":"2c802312-c4b8-484a-82d1-679db2afa5dc","resolution":{"observed_at":"2026-08-07T12:51:47.237834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07074","last_updated":"2021-12-14T00:20:55Z","snapshot_observed_at":"2026-08-13T17:15:56.592417Z","submitted_at":"2021-12-14T00:20:55Z","title":"Towards a Unified Foundation Model: Jointly Pre-Training Transformers on Unpaired Images and Text","version":1},"cited_work":{"arxiv_id":"2112.07074","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.07074","snapshot_observed_at":"2026-08-07T12:51:45.160996Z","title":"Towards a Unified Foundation Model: Jointly Pre-Training Transformers on Unpaired Images and Text","venue":"cs.CV","work_id":"f0c70487-bbb2-485d-a0c4-449e2442b2ac","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.918255Z"},"links":{"cited_paper":"/paper/2112.07074","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:65ed0f24916be1eb82df427da8f29e6e666391fe7786d14f9cda3944055925f4","observation_id":"1f905f67-e07a-4dbd-a8b2-c223ac3f5698","resolution":{"observed_at":"2026-08-07T12:51:45.236897Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.924960Z","title":null,"venue":null,"work_id":"4f811ed2-bf7f-48a5-afb0-f90654a766fb","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.022961Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:818de6a541d5b6880e8d3d8d0c8a2fbf5657fc1bcea788f8dc713feba5d3d84b","observation_id":"cf5dbd97-3c2e-4c3f-af13-53fa04874b80","resolution":{"observed_at":"2026-08-07T12:51:47.031634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.679886Z","title":null,"venue":null,"work_id":"4404449b-df5f-4ac6-b1b9-1cac7129194f","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.147214Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:aa254febfd113c6bb95c369fc5d679f1dce05b389bb871917022093d81207f6d","observation_id":"9ebf1166-87bd-4369-9f43-1a730cd1be23","resolution":{"observed_at":"2026-08-07T12:51:46.778455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:51:44.253334Z","title":"Wang , author S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.253334Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c46dc9e4c74c95b4c22d59b3d43150afd08fa7f20485ea96c0cff708ada8be7e","observation_id":"4e0b64b6-7f17-4f89-922d-e94da7d7d355","resolution":{"observed_at":"2026-08-07T12:51:44.253334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.442402Z","title":"Zhang , author D","venue":null,"work_id":"04b4a6a9-8b61-4820-964c-d0263fbd76f3","year":2015},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.358554Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:71d7fd90d84ee4d732a2ab5d9f32762a55797b465face71dbf361e94e92a912d","observation_id":"4f0e90e3-6bdc-41d6-99f0-d0689560c67b","resolution":{"observed_at":"2026-08-07T12:51:46.549473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.213604Z","title":"Tay , author L","venue":null,"work_id":"3bb950c8-6ac2-441a-8ec7-b3361ff5c844","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.452037Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:e7652abf2f0d71da9b0e2c2f37a139030ec05d0f40036ea6a07517659581c620","observation_id":"52fe89e2-d368-4966-9fe8-4d3c34c878fd","resolution":{"observed_at":"2026-08-07T12:51:46.343060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.950183Z","title":null,"venue":null,"work_id":"a0b41635-d2f5-480a-bfa3-b81ad81d54c0","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.546004Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:432debcc56df66eeb61e240faf57a73db667ce6722f0b831c3cd2a492fda7d95","observation_id":"d3a60ce2-c63c-4a55-a64a-705d48989b7f","resolution":{"observed_at":"2026-08-07T12:51:46.071608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.763251Z","title":null,"venue":null,"work_id":"f86271ab-fe7d-451b-aa68-acdacfe802cf","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.673326Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:6d436d4b79a6e311377a98b2282d608d4011229c52164a4e15dc917393d9c840","observation_id":"0c1642f3-cd1c-4416-b28f-0ccf87153e3d","resolution":{"observed_at":"2026-08-07T12:51:45.831220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.544991Z","title":"Brock , author S","venue":null,"work_id":"c7275740-745e-4f3f-af7a-e7382885d9a7","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.776891Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:6996bc535c875edb85f1407a47235c8fb81c5af52238ced04a67ffda8fc0a69c","observation_id":"f70fff46-3c0c-40a4-8323-91255c9b317d","resolution":{"observed_at":"2026-08-07T12:51:45.647570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.392336Z","title":"Schifanella , author P","venue":null,"work_id":"eb6c454c-f62b-4407-8094-b77c0a52848f","year":2016},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.880759Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:49c7d78c506ddac2d4888c2482f89e520f3eca7d58015d1f9074904c1ddec975","observation_id":"08a00fad-adf8-43fd-a88c-23be6983fa3f","resolution":{"observed_at":"2026-08-07T12:51:45.442384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:44.999434Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.999434Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:b11a3247c4dc96a22092d2638ac00634182b6c36166c5f107c63a206d46f530e","observation_id":"22fd90a4-c300-455a-8f2b-d2951b72cda7","resolution":{"observed_at":"2026-08-07T12:51:44.999434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 1 inbound Pith citation observation for arXiv:2505.23365."}