{"as_of":"2026-08-09T01:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77c4bb69b029806f7ed5fbd1307c0ca6a9689390ef19ae5e601df1c112511aa8","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:21:46.704747Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18683/citation-record","integrity":"/paper/2506.18683/integrity","json":"/paper/2506.18683/citation-record.json","paper":"/paper/2506.18683"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:39.986955Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:39.986955Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:8dffd05a2669a83fce9ef64c8565711532e760a3b69a1a64c587d5421b0665b1","observation_id":"dfb99ce4-b657-4d07-af93-651b75c56917","resolution":{"observed_at":"2026-08-06T23:21:39.986955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:39.659208Z","title":"AlexNet, [2] introduced key innovations such as the ReLU activation function, dropout layers to mitigate overfitting, and overlapping pooling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:39.659208Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:336673d401e0a139ab78361191b306f1d4fd1b73e45dc9f149a26a7aea8b671a","observation_id":"095011bf-e08d-4591-a0f6-85beb0fe8f34","resolution":{"observed_at":"2026-08-06T23:21:39.659208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:39.764813Z","title":"The core of our approach involves transforming 2D images into 3D point clouds that represent the targeted objects","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:39.764813Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:a8f9eab0b30055f080ea136c7d8d68ba17e2caa74eae172cc531c87dcdc7fb66","observation_id":"abadbbfc-c861-42a1-b57a-159bfa48da33","resolution":{"observed_at":"2026-08-06T23:21:39.764813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:39.898845Z","title":"The first se t of experiments ( cf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:39.898845Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:77b209b06ae4749b52010271764d245fb11b6218500eee68d73cc332c97091ac","observation_id":"e96e3499-64b2-42c0-8810-ae71624bffb8","resolution":{"observed_at":"2026-08-06T23:21:39.898845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:40.123848Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:40.123848Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:43ce9ad8e11f144f97e861ea51d8bdc6a77df498fcdf886613b24e7c8a131946","observation_id":"2a5e201b-c489-4883-bad1-b7e305caf5b9","resolution":{"observed_at":"2026-08-06T23:21:40.123848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:40.244819Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:40.244819Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:27872daf3a4572dc674464360819297234e86b0f65f52faf934cf27a4f8dfd9b","observation_id":"920cd955-db1f-4bb2-854f-b4c2872e77ad","resolution":{"observed_at":"2026-08-06T23:21:40.244819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:40.345073Z","title":"Additionally, we generated two enriched point cloud datasets for each trait–one within the selected series and one within the complete series","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:40.345073Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:86b480ee3e40469f00e0b092ed50d2ea276a252bf8b2d8535d7660b47aa2f60f","observation_id":"3cdf3ae5-eb79-44b4-b112-05f828624d5d","resolution":{"observed_at":"2026-08-06T23:21:40.345073Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:40.470271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:40.470271Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:912b68ae64606b9bb3d6f82e8c86f566ab44e8c980b2eb8d3b89b37305656afd","observation_id":"36045eb6-b08f-4e63-bc91-5dbd97ebe9cc","resolution":{"observed_at":"2026-08-06T23:21:40.470271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-06T23:21:42.139129Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., Krueger, G., & Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.139129Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:b77ddadec65645aa47743bd297633844cb8e88ef159de1e8fd199640c34fc314","observation_id":"e91709a5-3607-4a5e-bc8f-69e198af9299","resolution":{"observed_at":"2026-08-06T23:21:42.139129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:40.725502Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:40.725502Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:e18a161131953c670f12c1c68a9b64e44b731f3934194888ebfc7015d1307095","observation_id":"df755afe-3eb9-40bc-9a94-521904dac34f","resolution":{"observed_at":"2026-08-06T23:21:40.725502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:40.855187Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:40.855187Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:e5068aa900c14559a1227886ac1c0f4d676e52be655a02d65f724a6d35e7d7b0","observation_id":"db09d6ea-40a6-4617-a7df-fdd8b001d4f3","resolution":{"observed_at":"2026-08-06T23:21:40.855187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T23:21:41.061004Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:41.061004Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:23af7609ac66e0ed17bfa8e688b81ca078e915b6ea570f492e9c60e9de1f68e9","observation_id":"dfb1e52b-4935-4e32-a5c0-34a79ed72a9e","resolution":{"observed_at":"2026-08-06T23:21:41.061004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:41.294749Z","title":"Going deeper with convolutions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:41.294749Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:4f1e2c159debc397dd6b0a1a5b12993c8068be8aeccf45cf30cda2dc35136d6a","observation_id":"a3316fe4-154e-4860-bfd8-bbbfd7d05a9e","resolution":{"observed_at":"2026-08-06T23:21:41.294749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:41.573915Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:41.573915Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:0ac356c814c67a9cb3dcf6d115c8108a52875d8bdd3711f14d660a61e1c9d1c0","observation_id":"5358e7d1-6d58-4565-bf42-8d6a0906c48e","resolution":{"observed_at":"2026-08-06T23:21:41.573915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-06T23:21:41.704762Z","title":"N., Kaiser, L., & Polosukhin, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:41.704762Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:af5bdf5d11f00fcd728853ebb0ca8bbc64dc0d5477f016f7815e693b5e70d98c","observation_id":"2c7421b0-bcd4-464b-881e-0577271bc99f","resolution":{"observed_at":"2026-08-06T23:21:41.704762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:41.841453Z","title":"Q., Su, H., Kaichun, M., & Guibas, L","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:41.841453Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:b4fe27906d7c03fbe28a49c7f46ef47223aa99b6e652d003a110d639574ae5ee","observation_id":"9b7720c3-6e44-486f-963a-4713875554d5","resolution":{"observed_at":"2026-08-06T23:21:41.841453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T23:21:41.924745Z","title":"-W., Lee, K., & Toutanova, K","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:41.924745Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:c6ecf8deb6b11d01a0c313ec95f57d06854140fdea181cd471680db9ffa9c330","observation_id":"54a6fa12-f5cf-40be-bf8c-49ac6c6a9678","resolution":{"observed_at":"2026-08-06T23:21:41.924745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:43.134824Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.134824Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:1719b1cac1bf0f5acaa4c1933f59bcc095b23569392a45fec3dbb931058db52d","observation_id":"37ee58ee-02bf-4179-bb14-6d8f36cb1841","resolution":{"observed_at":"2026-08-06T23:21:43.134824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T23:21:42.265486Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.265486Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:dd0b62d271acd7cc196867707f76da63fb8a49c1e1785f6184a298c6914ea053","observation_id":"c042858f-434d-4351-a367-27b196922494","resolution":{"observed_at":"2026-08-06T23:21:42.265486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/aps3.1233","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:53.104221Z","title":"D., Ellwood, E","venue":null,"work_id":"ab1ed4e0-375a-4855-af5b-cae68cc0ec69","year":2019},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.413628Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:63710793ba1a79fab62239494f6bb6b54bc96534c1ba7c6ef9a05206a29ca219","observation_id":"093e0113-5c54-40a4-b8b1-b7b6cda956a5","resolution":{"observed_at":"2026-08-06T23:21:53.205359Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3897/bdj.8.e57090","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:52.696489Z","title":"Biodiversity Data Journal 8: e57090","venue":null,"work_id":"77e393c1-4cfd-4c81-bbf3-524366d81c25","year":2020},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.488137Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:287eb23fa56621c6e917fce1f1e74e33775624451a974d736f89a21703efaa74","observation_id":"eacfe43c-a3cd-4878-8b55-0a0e071f74dc","resolution":{"observed_at":"2026-08-06T23:21:52.890095Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:42.542709Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.542709Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:388995876024f8f6c6fb99e663afd46e131bc636726755611cfa69d21aea0fbe","observation_id":"a71bb53f-eec0-4ce7-983f-ce748060a64a","resolution":{"observed_at":"2026-08-06T23:21:42.542709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3897/biss.8.135629","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:52.450066Z","title":"Biodiversity Information Science and Standards 8: e135629","venue":null,"work_id":"d5fed73c-3bea-498e-8918-163efceeceb9","year":2024},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.649408Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:041fe7d115529f6e7bcd3e5a60980215110ff0b8b18be110aeeee57702654eec","observation_id":"7c870d1f-9755-425c-95b2-dbcd626d3037","resolution":{"observed_at":"2026-08-06T23:21:52.534749Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-88226-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:52.082961Z","title":null,"venue":null,"work_id":"db05f30e-d296-4438-8c9a-1f6de29708ad","year":2025},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.794750Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:44bc1fcf42dccd1350b25de8e85ec1fa00d4f637e8c6df8fe3a42ad01662ee6f","observation_id":"8bc01db7-2e67-4cbf-917d-1dc3bbe87362","resolution":{"observed_at":"2026-08-06T23:21:52.184743Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/aps3.70000","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:51.815636Z","title":"Sklab, E","venue":null,"work_id":"28e8d805-4f74-4075-8012-3f007078fab9","year":2025},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:42.900612Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:d7e82ed96cd0b1932dd490eb7728300e5aa46e0cbdf48236a42e33403cd18862","observation_id":"422fae28-7adb-457f-b948-a34a000e79a6","resolution":{"observed_at":"2026-08-06T23:21:51.954771Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-981-97-2253-2_18","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:03:45.533247Z","title":"(2024) Enhancing YOLOv7 for plant organs detection using attention-gate mechanism","venue":"Lecture notes in computer science","work_id":"8831e00b-368b-4f40-9a57-e8de312ec45e","year":2024},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.034771Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:e722af508e461e60a22525cbad6fee6d5bf4b09a95204a6edb71bff01ef24b96","observation_id":"68b13f26-423c-46bb-ba86-940e1f8c787e","resolution":{"observed_at":"2026-08-06T23:21:51.514819Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.patrec.2021.08.028","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:49.994894Z","title":null,"venue":null,"work_id":"be45f703-93bd-4793-8db5-0fe2d2aa3337","year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.483228Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:b0428e069dcaf6d5f8d1f14c5802f809db235f9acd90a27dbade36cf2fa94c90","observation_id":"c95436c6-45a5-45a0-85ac-08088f476c7d","resolution":{"observed_at":"2026-08-06T23:21:50.114760Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.10391","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:55.670014Z","title":"T., Zhao, J., & Itti, L","venue":null,"work_id":"b0f588a5-e3cd-42f4-857c-a55129c0f3d2","year":2020},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.373835Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:b42a04e309e7e42b5e4ae26ce97728d7fecb1e108379b0e1a4814a5f4624220e","observation_id":"e65c3368-bb27-49d1-bfd9-8991fcfb6036","resolution":{"observed_at":"2026-08-06T23:21:55.754749Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3897/biss.7.112666","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:50.664760Z","title":null,"venue":null,"work_id":"c34953b5-39b5-431e-bc18-a8aa02c21979","year":2023},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.454241Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:5f03315e97a9c9e190704fc57cd76bc96e0b97351ef786daf2c466c631754d4d","observation_id":"484e665b-bb98-4afb-874f-6686380ca03d","resolution":{"observed_at":"2026-08-06T23:21:51.234747Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:43.584746Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.584746Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:0e30bec9389ae0cd63440fa2a121d363f475a183918de0169ca6c5f96335c308","observation_id":"3af722cb-5c0e-4e1c-8fe4-b249d8efd6d9","resolution":{"observed_at":"2026-08-06T23:21:43.584746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.imavis.2019.10.003","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:49.144739Z","title":"S., Do, N.-T., Kim, S.-H., Yang, H.-J., & Lee, G.-S","venue":null,"work_id":"f7e22684-3fdd-4348-88b5-c13b0828a0b9","year":2019},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.904752Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:49fe8f6b7644f88788e8d7d5669eddd023efc723c589356c808a3daee9b94815","observation_id":"c30ce205-1ac4-41bb-8326-b9359aa0b3cb","resolution":{"observed_at":"2026-08-06T23:21:49.265071Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:43.841676Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.841676Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:3fe4bee7c6905e6ab2baf2305c8bc515dcdda2eac11c0f14fb4f177021a9e4cf","observation_id":"fc919db8-cb73-49bf-a0fc-1fc89aafbaa9","resolution":{"observed_at":"2026-08-06T23:21:43.841676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:43.930368Z","title":"R., Yi, L., Su, H., & Guibas, L","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.930368Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:b86f0cca3ca274dda919194d43ae31b2eed5c7321d9c80ae711cfb9e54a7a650","observation_id":"b1001036-d852-4fde-bb85-06de3a906c0b","resolution":{"observed_at":"2026-08-06T23:21:43.930368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:44.086774Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.086774Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:fb2331a5bc9f10a2a6120ae545584ff971fc96fc2dcfbf3632eb0ed4faae1104","observation_id":"840c3dee-bc09-4dec-a2df-3d18f1a9da41","resolution":{"observed_at":"2026-08-06T23:21:44.086774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:44.180022Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.180022Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:aafa8dd01a53113d60c8438f850a0ef88d7e481ea1390a8a54ca5a115308ab83","observation_id":"14d32383-bcf8-42bf-825f-a91537783a63","resolution":{"observed_at":"2026-08-06T23:21:44.180022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:44.297003Z","title":"A., Elhoseiny, M., & Ghanem, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.297003Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:8c6701719df5bdd42d775438dc6178d2a4a89fe3f854b34adfa761f96b8d76d1","observation_id":"c62c8d91-0f34-47b8-b0e5-0aed92a64d62","resolution":{"observed_at":"2026-08-06T23:21:44.297003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.01012","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:54.205343Z","title":null,"venue":null,"work_id":"97f1424b-197e-4e37-8b15-f7a59e41975a","year":2019},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.644745Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:45b63b76e74637995b2909e2dea494662513c46781411abb28dc4d3059db2122","observation_id":"673dfea5-5988-4717-9c5e-8d5fbcde5654","resolution":{"observed_at":"2026-08-06T23:21:54.431714Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.33317","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:55.015269Z","title":"L., Qin, J., & Wei, M","venue":null,"work_id":"c6f46953-6ce5-43f7-8323-c5e79b51d13f","year":2024},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.586011Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:70fe45fb6ded3b8abc807272c26839ac399a4fff2624f5bf353195ec7d692e07","observation_id":"a0f90f1e-b93e-4429-ba32-2fed2174660a","resolution":{"observed_at":"2026-08-06T23:21:55.183248Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/rs11242961","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:49.736255Z","title":null,"venue":null,"work_id":"4248b5db-ee47-4320-bd86-4c384d4ad601","year":2019},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.694743Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:96c032f4bee35279ac27a71aaa13561ff965417d816d053bd9bcc7f46171592b","observation_id":"394c2ef7-e79f-4f64-9ad0-ab3584cb4688","resolution":{"observed_at":"2026-08-06T23:21:49.854750Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.cag.2023.06.004","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:49.484747Z","title":null,"venue":null,"work_id":"f8be1e73-e19d-4122-a6cd-018ef2ab45dc","year":2023},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.824828Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:ecbccb41470d5818b2122a418a0dcd089fb814d117e3f35ecb73ac42a7bd8add","observation_id":"191f3f0d-e6e6-419b-b204-1b25b051bda0","resolution":{"observed_at":"2026-08-06T23:21:49.614748Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03545","last_updated":"2022-03-02T15:08:16Z","snapshot_observed_at":"2026-07-06T12:26:09.094759Z","submitted_at":"2022-01-10T18:59:10Z","title":"A ConvNet for the 2020s","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03545","snapshot_observed_at":"2026-08-06T23:21:46.094812Z","title":"-Y., Feichtenhofer, C., Darrell, T., & Xie, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:46.094812Z"},"links":{"cited_paper":"/paper/2201.03545","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:18a17f4937a974d156f6c564d0796a21e470f20d424f74e15d928d7bfa043f38","observation_id":"1d315bc2-e21a-4d04-a218-6cf078e7ed76","resolution":{"observed_at":"2026-08-06T23:21:46.094812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-06T11:05:16.105361Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-06T23:21:44.995708Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:44.995708Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:6feea1885cdcde3abb65178839c79b58a5da075186b24895e7ebe28622ffdebc","observation_id":"f936840d-6282-4228-ab24-7cf7ca5e36ca","resolution":{"observed_at":"2026-08-06T23:21:44.995708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3897/biss.7.112161","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:48.565318Z","title":"-D., Prifti, E., & Chenin, E","venue":null,"work_id":"674ddc48-9df3-450a-bbc5-518ad6fec286","year":2023},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.124840Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:dbd80d6b166fd23b572b1bbfa15a88889e092e4916661a5254168650ea870d99","observation_id":"265eed0a-380a-4230-8097-05d7fae8b94b","resolution":{"observed_at":"2026-08-06T23:21:48.742272Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:45.243683Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.243683Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:78625a986c9701528de0cbfc850b4741b9850330b1ca1fdbf1e885983c772743","observation_id":"577d8336-c343-44da-ad80-32afd66205be","resolution":{"observed_at":"2026-08-06T23:21:45.243683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:45.375676Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.375676Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:7e83b61dd6dd3ae11e6cc4f596b638487e9a5a70e50217e9f2ec59194e87ef07","observation_id":"1b0b22f8-b38a-41f9-ac1a-e3db88f5521e","resolution":{"observed_at":"2026-08-06T23:21:45.375676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73030-6_27","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":null,"venue":"Lecture notes in computer science","work_id":"6738fc32-df1a-44c0-a02e-adc33d0c077b","year":2024},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.510363Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:d408f52820901a8396bc719aaad2cd966b5ec35ec71b25c9531bdfcbd4f1ffea","observation_id":"52fa7697-124d-4446-b475-226fcdd0fd7f","resolution":{"observed_at":"2026-08-06T23:21:48.372897Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.30248","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:53.834749Z","title":null,"venue":null,"work_id":"487e8a2d-e898-4d16-9a34-5688d977da95","year":2020},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.714819Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:a4444f5e3e0cf855485d8b28053f79bb5c54c0894e3986b4f75555e3d4d8e260","observation_id":"f05096d4-cd41-43e8-b6f4-e6186f768519","resolution":{"observed_at":"2026-08-06T23:21:53.975110Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-06T23:21:45.814776Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.814776Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:41b69984f95c0abff47d4c7d11de4aef4c449b7dff740e517245c244d6555b40","observation_id":"fa992bed-393b-4c0b-ae76-b759710d7896","resolution":{"observed_at":"2026-08-06T23:21:45.814776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04803","last_updated":"2021-09-15T06:05:13Z","snapshot_observed_at":"2026-08-07T09:48:03.342247Z","submitted_at":"2021-06-09T04:35:31Z","title":"CoAtNet: Marrying Convolution and Attention for All Data Sizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04803","snapshot_observed_at":"2026-08-06T23:21:45.974828Z","title":"V., & Tan, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:45.974828Z"},"links":{"cited_paper":"/paper/2106.04803","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:be00f51f39f05bbaef974ee7093ec3ecf6b3c4c89cf2c1611102d5d5df4fe3c8","observation_id":"2c9c4fae-ac83-4d4e-8b8e-4d89912c42c4","resolution":{"observed_at":"2026-08-06T23:21:45.974828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00808","last_updated":"2023-01-02T18:59:31Z","snapshot_observed_at":"2026-08-08T08:01:57.986531Z","submitted_at":"2023-01-02T18:59:31Z","title":"ConvNeXt V2: Co-designing and Scaling ConvNets with Masked Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00808","snapshot_observed_at":"2026-08-06T23:21:46.234887Z","title":"S., & Xie, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:46.234887Z"},"links":{"cited_paper":"/paper/2301.00808","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:b3efac9786b65bedc72508c10e8790ccf5dfcc538d761ae829dc6bb88c7dcb6c","observation_id":"2b3e19f3-5e97-427e-ade1-76425bf5ffbd","resolution":{"observed_at":"2026-08-06T23:21:46.234887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:46.374201Z","title":"L., Morcos, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:46.374201Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:8bac2212b928f8aba52ef5aeba6c081a9ef78a2645919a2f9177783781445916","observation_id":"0b4bb9db-ff80-4c7f-84f0-aebb2f7a3e2d","resolution":{"observed_at":"2026-08-06T23:21:46.374201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14030","last_updated":"2021-08-17T16:41:34Z","snapshot_observed_at":"2026-08-07T00:32:15.123562Z","submitted_at":"2021-03-25T17:59:31Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14030","snapshot_observed_at":"2026-08-06T23:21:46.541058Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:46.541058Z"},"links":{"cited_paper":"/paper/2103.14030","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:0081534427977710a47346bdc131d37242d7ec5fa78d6b4ba07da1d99109f8a5","observation_id":"e20ca8c8-3810-4f1d-8e41-0216dd3fc2bd","resolution":{"observed_at":"2026-08-06T23:21:46.541058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03645","last_updated":"2022-04-07T17:59:32Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:32Z","title":"DaViT: Dual Attention Vision Transformers","version":1},"cited_work":{"arxiv_id":"2204.03645","doi":"10.48550/arxiv.2204.03645","metadata_source":"pith","pith_arxiv_id":"2204.03645","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"DaViT: Dual Attention Vision Transformers","venue":"cs.CV","work_id":"29d35b9a-4082-458f-8f1e-427baa4ba193","year":2022},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:46.704747Z"},"links":{"cited_paper":"/paper/2204.03645","citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:ff052bf832c220c10a4ee28041dd0db96fe23a97ac0c19d11dd4d8f1a270ed55","observation_id":"f4a45aa2-f316-4681-bef3-bbc69c1454b5","resolution":{"observed_at":"2026-08-06T23:21:47.025745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:40.606522Z","title":"Color -coded coordinate masks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:40.606522Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:a37a3d8a969fa28db9483a63ad85db09e957b30f9376de2590e9e0b441821961","observation_id":"5da39c58-b251-4b0c-8313-0e4b3b239170","resolution":{"observed_at":"2026-08-06T23:21:40.606522Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/rs13204029","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:50.334742Z","title":null,"venue":null,"work_id":"69dfbbb6-6c83-4408-a75a-280d4c84b0f9","year":null},"citing_paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification","version":1},"reference_index":4029,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:43.734750Z"},"links":{"citing_paper":"/paper/2506.18683"},"observation_digest":"sha256:cb080b5c4af6d94f7251ab5e6221599ae40fb822d9193bbbb9758897aa2c8f4b","observation_id":"9c83a077-7f2e-48ac-8ea5-591987d9fce5","resolution":{"observed_at":"2026-08-06T23:21:50.474941Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.18683","last_updated":"2025-06-23T14:25:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T19:58:42.308580Z","submitted_at":"2025-06-23T14:25:40Z","title":"SIM-Net: A Multimodal Fusion Network Using Inferred 3D Object Shape Point Clouds from RGB Images for 2D Classification"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":3,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":34,"verified_exact":15,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2506.18683."}