{"as_of":"2026-08-08T08:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3313042468b465f5663e3b7436832136187d3fba9abdf564011f56444f7000d4","coverage":[{"denominator":105,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T20:14:03.709995Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:48:37.280104Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:48:42.262210Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"cited_work":{"arxiv_id":"2502.09906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.09906","snapshot_observed_at":"2026-08-07T00:48:42.262210Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","venue":"cs.CV","work_id":"5f9a397e-32ee-47b6-8183-5f10393549f8","year":2025},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-07T11:53:13.790399Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":278,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:37.280104Z"},"links":{"cited_paper":"/paper/2502.09906","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:f546ad16bbc1cc66d532a34186b44df2b5542727c65a161bdd3c35f7468c94ca","observation_id":"0aff1f99-02cd-41e2-82a9-71217b9903af","resolution":{"observed_at":"2026-08-07T00:48:42.344777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09906/citation-record","integrity":"/paper/2502.09906/integrity","json":"/paper/2502.09906/citation-record.json","paper":"/paper/2502.09906"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.304844Z","title":"Advances in neural information processing systems 35, 23716–23736 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.304844Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:023f73da8150c08377d35fc5e6dd92e98d478614722f4018006700350ef19c64","observation_id":"37404bae-606d-4b30-943a-bd9002d3a324","resolution":{"observed_at":"2026-08-07T20:14:03.304844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-07T20:14:03.310025Z","title":"arXiv preprint arXiv:2309.17421 9(1), 1 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.310025Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:201c3b88e3555a3c1d749256b4569909f4dfe55c4f04a4f2ff63cccbd1b55530","observation_id":"76ed1aca-c06b-47ab-8f55-c1af14a98704","resolution":{"observed_at":"2026-08-07T20:14:03.310025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.314595Z","title":"Foundations and Trends® in Computer Graphics and Vision 16(1-2), 1–214 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.314595Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:cc4b6837c39515c9b720bd22fb38761c5a80f2aef3e993211029efa7b1e5b02b","observation_id":"54b661c5-8c48-420a-9489-cdcd81dfae23","resolution":{"observed_at":"2026-08-07T20:14:03.314595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.318622Z","title":"Advances in neural information processing systems 36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.318622Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:26aba4859e7f63e4d098ba9ab0a51ebf4ca9e84e857387f3652aa7e25dc40a30","observation_id":"60b2b848-b6e6-45ac-bfc0-f70e05268ca1","resolution":{"observed_at":"2026-08-07T20:14:03.318622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.323591Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.323591Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0cbe2e16b2408957f02f6a2c489b0bca5aff04de880f60b717ed67b6cf0cec0f","observation_id":"fd3671b6-b7d2-41e4-94d7-e9ce17156e61","resolution":{"observed_at":"2026-08-07T20:14:03.323591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.327648Z","title":"Advances in Neural Information Processing Systems 36 (2024) 30","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.327648Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:dbcb46fc95dee776fdd4bea3863c766816b02ba79d5e05df2af834033f220d15","observation_id":"5a79ad11-faa6-4968-9ca4-6e58fac87849","resolution":{"observed_at":"2026-08-07T20:14:03.327648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.332170Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.332170Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:34af63473565a855190c71732e6abb21a4f1a48265edab525924ab57f25019c9","observation_id":"f3fe8569-d0da-4183-a646-e2e3e336e931","resolution":{"observed_at":"2026-08-07T20:14:03.332170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.336076Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.336076Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:37c59b1943e1d9b633e87be6511d4503d9ecb1d46a0081727637270c9e5e92a7","observation_id":"457331e6-9659-412f-a7be-dded7d066283","resolution":{"observed_at":"2026-08-07T20:14:03.336076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13022","last_updated":"2024-02-20T14:02:45Z","snapshot_observed_at":"2026-07-06T17:32:52.500465Z","submitted_at":"2024-02-20T14:02:45Z","title":"SoMeLVLM: A Large Vision Language Model for Social Media Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13022","snapshot_observed_at":"2026-08-07T20:14:03.339805Z","title":"arXiv preprint arXiv:2402.13022 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.339805Z"},"links":{"cited_paper":"/paper/2402.13022","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:dce037b7d440f43936775501a4531ccf0217b3e04f888798bb3a80001677762c","observation_id":"2d2acd22-7c27-4677-9200-e08af22d92b7","resolution":{"observed_at":"2026-08-07T20:14:03.339805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.344094Z","title":"In: Oh, A., Neumann, T., Globerson, A., Saenko, K., Hardt, M., Levine, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.344094Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:baeda40e4bc60f42edecc5a0130c0b3a8719715c4768a78a9a154b80a38e4f93","observation_id":"a4e73dad-df90-45ef-81fe-1cd2d1b1df4b","resolution":{"observed_at":"2026-08-07T20:14:03.344094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T20:14:03.348114Z","title":"arXiv preprint arXiv:2112.00861 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.348114Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:aa4c9244e9d6614775cb01a69512fc6a37ff6bf3d16d320565f257f6137666d1","observation_id":"87ea1479-272c-4ce7-b73f-ce790a569541","resolution":{"observed_at":"2026-08-07T20:14:03.348114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.352239Z","title":"Foundations and Trends ® in Computer Graphics and Vision 14(3–4), 163–352 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.352239Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:8fddbb55140708dafdbfc7a9710f24b454df2b87cf4a26769d7fecf6651322b4","observation_id":"a71cf9ed-31e4-4bfa-9bcc-64370557751f","resolution":{"observed_at":"2026-08-07T20:14:03.352239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.355930Z","title":"Advances in Neural Information Processing Systems 35, 9287–9301 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.355930Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:91e554a9f551451778b86615b9e1b8cfed034b50d8b10d6db4b0283f99b7c602","observation_id":"6385276a-f0a2-4db6-986a-66da21d14dd4","resolution":{"observed_at":"2026-08-07T20:14:03.355930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.359442Z","title":"International Journal of Computer Engineering Science (IJCES) 2(6), 1–13 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.359442Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ae17e533006aa774c8498f21c838d3b84d142398cac956918c98813ac667de07","observation_id":"440923f7-87af-4dff-a0b5-6295d13d4f53","resolution":{"observed_at":"2026-08-07T20:14:03.359442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.363361Z","title":"Knowledge-Based Systems 33, 102–110 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.363361Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:c7b279e2f1aa1e3196a8e810d4aef74b95303febb117d4c6a564714751a611c1","observation_id":"03eaa6c5-5cad-4bee-97de-ee9b32f4af35","resolution":{"observed_at":"2026-08-07T20:14:03.363361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.367415Z","title":"International Journal of Machine Learning and Computing 4(1), 1 (2014) 31","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.367415Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:e9411d9f3622c083bec38c461edcfbcc7283d974bc05160a06e7ac1ccce861c5","observation_id":"1c515d7c-8c9a-4ca0-8d66-ff9387ee5037","resolution":{"observed_at":"2026-08-07T20:14:03.367415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.371458Z","title":"Computers and Electronics in Agriculture119, 123–132 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.371458Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:9f568a4110750740c969c85de6ee502622abbf32d23f178e833d049e3ec90266","observation_id":"31696014-b7ad-41e0-a959-774d69e27948","resolution":{"observed_at":"2026-08-07T20:14:03.371458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.375318Z","title":"Scientific reports 6(1), 20410 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.375318Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1dbccc47d0b21d84222f61c5cba488b419dcd8f90ab89b4a98d36a645bae715a","observation_id":"fcd57f5a-95f7-477f-81d6-13f7490d8f25","resolution":{"observed_at":"2026-08-07T20:14:03.375318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.378943Z","title":"Computers and Electronics in Agriculture 152, 233–241 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.378943Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f028cfa1e9174b0d070962e92e190d2b99cae344c5ff153b6a69a555b65fb092","observation_id":"5cf598d2-bbcd-4870-beab-82f20dfc8a5c","resolution":{"observed_at":"2026-08-07T20:14:03.378943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.382898Z","title":"Biosystems Engineering 169, 139–148 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.382898Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:19514680aa6412562544a6dba03b16c3e309e220a87ebdc234f305fa1ef43187","observation_id":"b1ca30ab-8bf5-4e49-822d-9bd71b274534","resolution":{"observed_at":"2026-08-07T20:14:03.382898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.386714Z","title":"In: Proceedings of 2018 International Conference on Mathematics and Artificial Intelligence, pp","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.386714Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:89582f65ffed9b923dbc33367e602b7efbf600df2c5aa9d95c9d1fed788d091b","observation_id":"7b4333f7-ece9-452b-b061-7744bf7a621f","resolution":{"observed_at":"2026-08-07T20:14:03.386714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.390455Z","title":"Ieee Access 7, 45301–45312 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.390455Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:263ecc428c58d3ccd8bdf476f1dfd9bdc95282a2f0769c7a896dbd5d3afcc250","observation_id":"c874fe8e-9c5a-4e1d-bd4e-85daca32c2fd","resolution":{"observed_at":"2026-08-07T20:14:03.390455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.394045Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.394045Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b06636b482c61341d9edb6ca8912129131db1be9299fcffc4723a651920bfa19","observation_id":"e39be50a-7d9e-4ac4-b98e-1530d7adeb35","resolution":{"observed_at":"2026-08-07T20:14:03.394045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.398361Z","title":"Sensors 21(5), 1601 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.398361Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b77e9575956376091249492b7818ba7db416b26799f20570c759beb0e696ade8","observation_id":"8314e02e-7e28-499d-b43f-47e9e019031f","resolution":{"observed_at":"2026-08-07T20:14:03.398361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.402494Z","title":"Advances in Neural Information Processing Systems 34, 19352–19362 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.402494Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1d2870fa57ca12ebdda06ad5154dec8b9683a435e16c285623022484cc4355ec","observation_id":"3f19b5f1-f6bd-4dd1-acfc-163f4db52ad6","resolution":{"observed_at":"2026-08-07T20:14:03.402494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.406708Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.406708Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:cb434bf73848036a86c1d01fc18117994bdf82fbc62c9246a012d447fc94defe","observation_id":"6a3f8765-9406-4c21-8fa7-313d3657095f","resolution":{"observed_at":"2026-08-07T20:14:03.406708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.410874Z","title":"In: Proceedings of the IEEE/CVF Conference on Com- puter Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.410874Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0c8dbb3b211e16f024f2acbccada2a4f1a03ffbb2d7c65d76e78cf7f9b613bc3","observation_id":"f5ebeb90-c133-4b17-9240-3432b0201c98","resolution":{"observed_at":"2026-08-07T20:14:03.410874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.414841Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.414841Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:c07d90f0fe10a8a938190478cdc03b7a89e625050f47bd266321c25b9a618826","observation_id":"1d6dec26-c7d9-456b-87a2-b25259ac868f","resolution":{"observed_at":"2026-08-07T20:14:03.414841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-07T20:14:03.418739Z","title":"arXiv preprint arXiv:2003.04297 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.418739Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bad7396841a19af02351bea8f647623553e9108b6f5417964dc72a99bf2760dd","observation_id":"6afe6eff-3ddb-4efa-a0f5-41271803313b","resolution":{"observed_at":"2026-08-07T20:14:03.418739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.423671Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.423671Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:752cf5f988fd1cf809cd9d6717585e4a6534a4799591a9321f04d6446bc92341","observation_id":"77c42442-f315-44b9-abc4-8ce86291c80c","resolution":{"observed_at":"2026-08-07T20:14:03.423671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.819236Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"afdb6f6c-f256-4bed-b357-6756417519e8","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.427630Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:e32602cef4af4f50fe029edc9dd33dad6eda81e3bdaeababf80c7e70d6537e3a","observation_id":"0f05c0c2-5747-4b1a-97ed-ed263aefdd19","resolution":{"observed_at":"2026-08-07T20:14:04.823268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.431647Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.431647Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6f7d570f8259b6e5f60576a0e15fb633deb9fe10502af6f01d7185f43e7a98f4","observation_id":"cc50681f-8de4-4a93-af89-c876f964ee10","resolution":{"observed_at":"2026-08-07T20:14:03.431647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.435589Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.435589Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:72aba5dbba4158ba4c1ed559cb9d96a6c18cf00560e3696c41eea6514a488e76","observation_id":"f21b0a71-63f9-47f4-a0ce-5bf923a96c1e","resolution":{"observed_at":"2026-08-07T20:14:03.435589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T20:14:03.439692Z","title":"arXiv preprint arXiv:2304.07193 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.439692Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:5d690c6aff9a396a55a18f85afa78dd33bb003b282d6b52b7cc136a9738255d0","observation_id":"ed707109-b829-4364-97b2-4ca2c0aa55c1","resolution":{"observed_at":"2026-08-07T20:14:03.439692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.443937Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.443937Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:fa3fa374f2591f7b0213baac11d79a2e4b524ba3cd117009d4a4a1f4876da4df","observation_id":"b6bc50e2-8fa1-4e14-8c4f-7026cda6e07b","resolution":{"observed_at":"2026-08-07T20:14:03.443937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-07-06T13:06:27.153765Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-07T20:14:03.447952Z","title":"arXiv preprint arXiv:2205.01917 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.447952Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6bb479b6e89b828f8c6c186a165eae5e870cd24cf091831899f4f8cb9563375e","observation_id":"965023a3-95d7-498e-9c91-b8a7240ffe7d","resolution":{"observed_at":"2026-08-07T20:14:03.447952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.452103Z","title":"In: 2009 IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.452103Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0c2bbc923a1c542cf3a1ad4b4131a2533f1d24addacad71307f21cf47e0cfdb2","observation_id":"48568a13-0e90-43db-8f5c-3f0c09fbc550","resolution":{"observed_at":"2026-08-07T20:14:03.452103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.456039Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.456039Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1eb8cd6b147e83335cca706d91a5bd439b80df8e38d57037894c4ec5f9d5fd50","observation_id":"e56bb9d5-bec8-4907-93f2-55451d98abe2","resolution":{"observed_at":"2026-08-07T20:14:03.456039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.768212Z","title":"Advances in Neural Information Processing Systems 35, 25278–25294 (2022)","venue":null,"work_id":"51a8d8b2-6448-4645-a7f4-2d9a457487ea","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.459913Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:af8295f09f70aad566d42827f6233cc6eab669389d56e9ea072ba95d6bff1d75","observation_id":"adf7200f-80c0-4fbb-9b35-9e18983c814c","resolution":{"observed_at":"2026-08-07T20:14:04.772142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.755781Z","title":"Computers and Electronics in Agriculture 174, 105488 (2020)","venue":null,"work_id":"92c56738-302f-4e8a-b3fb-ac84bfcc688e","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.464155Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ec1892a7291f1f35ed4b9dd7967a65d7d350bacd11c7f8aefc5b4276cd3de767","observation_id":"23660d3e-e2f0-4323-9ac3-1fa9cf8a3fa1","resolution":{"observed_at":"2026-08-07T20:14:04.759733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.744515Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops, pp","venue":null,"work_id":"680ab013-2284-4b7f-99fa-90b99b0d858f","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.468216Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:9eebea9468a97871c30943077041e491ebb00332ee87728b12b9f61f43e444f8","observation_id":"24ae42b4-7369-4612-90f3-e34b3387b7a1","resolution":{"observed_at":"2026-08-07T20:14:04.748477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.732166Z","title":null,"venue":null,"work_id":"3ee30160-8f92-443b-88a9-1202d3c04ed5","year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.473390Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1c56c377b68ddec0d91559dfc7f3f071be41893965896b6b5b8cfd15b36cc87d","observation_id":"2a48fc60-2536-4517-8eb3-74cac0c37bc1","resolution":{"observed_at":"2026-08-07T20:14:04.736799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.719916Z","title":"barcodinglife","venue":null,"work_id":"57a491c1-f017-46ac-a4a7-0e992d2a2276","year":2007},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.477561Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:5f5a3045e58676d3a25d970cb18589af7288e7a0cc5318e04c615e3b4c7b9905","observation_id":"2708bd16-6429-46a7-9c3e-ec94bcc85cd2","resolution":{"observed_at":"2026-08-07T20:14:04.724062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.707906Z","title":"in 2021 ieee","venue":null,"work_id":"cc8dfa02-c4ed-4da9-9259-64b3661bd4f9","year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.481706Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ed3881d8e5528aa1332d0adfda04d6edc88f0a0ab7922c780c52eab941100045","observation_id":"323ed7b2-dd32-4717-84ac-07730d5905fc","resolution":{"observed_at":"2026-08-07T20:14:04.711927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.695455Z","title":"Pattern Recognition Letters 166, 53–60 (2023)","venue":null,"work_id":"724a721d-b9ea-4c5f-a816-0213613d3e01","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.486020Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:def5323dbc2c85aff85eb1089c03b3dbf28ecc50e6adabf2df17f1024781f795","observation_id":"3bd94d62-ac21-424d-bc64-aa6635bfb926","resolution":{"observed_at":"2026-08-07T20:14:04.699632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.682620Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"3696f90e-33b1-4c5c-ba1d-bc13fb33f071","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.489916Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a7892fca16b887d802dcd4a4e3bd1d132326641c1ce4b500761a9e5af6c2dddc","observation_id":"0cd87202-47a9-49e8-afa5-7e76f81eeaa4","resolution":{"observed_at":"2026-08-07T20:14:04.687378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.668336Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"5be52b2d-34a6-4e28-afb3-f2710f82e98a","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.493778Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7be20faf99edbaa08cddfe3d7216a65db46cc3559b006d361f58cf557dd408c5","observation_id":"a782d83b-04e8-48bc-af90-12f1659a67f5","resolution":{"observed_at":"2026-08-07T20:14:04.674061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.497268Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.497268Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bb8ba2734771d00d0a5d0825ff19ec305956bff299908d5eaddfc2d9031418bd","observation_id":"70f90358-800f-43c9-af5e-83a5eaa2ddbc","resolution":{"observed_at":"2026-08-07T20:14:03.497268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.648970Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":"4032e9e3-96b3-4c16-9b4d-c82050400f4a","year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.500975Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7045c98b00c13072e64d7b7c686e2ed6eda7d72d22948b63f38115f6e046f3bc","observation_id":"cfa121c1-c60c-450b-9a2b-50e5412f6753","resolution":{"observed_at":"2026-08-07T20:14:04.652901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.636499Z","title":"Advances in Neural Information Processing Systems 36 (2024)","venue":null,"work_id":"d65543e1-e3f1-45ed-8885-bb537c85c102","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.505088Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:52079a1cd0641ca7b3a43653e93fa2e122a143003b0cecf4827fe2598dda64da","observation_id":"d98ceb0b-a543-4041-b693-10fb292f801f","resolution":{"observed_at":"2026-08-07T20:14:04.641170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.621964Z","title":"In: IEEE/CVF Computer Vision and Pattern Recognition (CVPR) (2023)","venue":null,"work_id":"1221bfe8-b7a0-4f03-bf12-f7e9cf300599","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.508994Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:41d5668aa9923b8747299c5c88cf0505bdef9817828edd4c87b3fd816117c427","observation_id":"cbf97497-759e-4e0e-9fc5-2fa420c9b7d4","resolution":{"observed_at":"2026-08-07T20:14:04.626627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.609969Z","title":"Neurocomputing 543, 126198 (2023)","venue":null,"work_id":"b5ff1690-8c8d-4d29-8e27-cc63857e3a3f","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.512813Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:dd28a67817af0733fea1c3ee11152df536b07554e1325ac09524e0102386bcff","observation_id":"985476fd-039a-40a1-ab09-2b7414acbe45","resolution":{"observed_at":"2026-08-07T20:14:04.613949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00236","last_updated":"2024-11-26T17:38:28Z","snapshot_observed_at":"2026-07-06T16:55:25.413169Z","submitted_at":"2023-11-30T22:39:23Z","title":"Brainformer: Mimic Human Visual Brain Functions to Machine Vision Models via fMRI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00236","snapshot_observed_at":"2026-08-07T20:14:03.516791Z","title":"arXiv preprint arXiv:2312.00236 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.516791Z"},"links":{"cited_paper":"/paper/2312.00236","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:5c273550b94bbe1dfabaf113d41a8b1fb3299a400cf9b7ce1bb6ba38355aeedd","observation_id":"e6998f3d-f3c3-4345-8da8-d72a0cb510d3","resolution":{"observed_at":"2026-08-07T20:14:03.516791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07408","last_updated":"2023-09-18T14:38:44Z","snapshot_observed_at":"2026-08-03T17:32:00.586216Z","submitted_at":"2023-04-14T21:59:32Z","title":"Fairness in Visual Clustering: A Novel Transformer Clustering Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07408","snapshot_observed_at":"2026-08-07T20:14:03.520726Z","title":"arXiv preprint arXiv:2304.07408 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.520726Z"},"links":{"cited_paper":"/paper/2304.07408","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:3df2255d958979d415add38e67cd62cfee19400e4c7c91717aa836717102380b","observation_id":"fd624c26-d1d7-47ad-849a-537867d8f470","resolution":{"observed_at":"2026-08-07T20:14:03.520726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.524780Z","title":"IEEE Access 8, 162973–162981 (2020) https://doi.org/10.1109/ACCESS.2020.3021469","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.524780Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:97bb6bb659a84afc0faf796d1a3b7834239db06047abb5d60330c8bea6f6e545","observation_id":"9ef51b05-fb8d-4763-a4ad-47e9fa1a19c5","resolution":{"observed_at":"2026-08-07T20:14:03.524780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15948","last_updated":"2023-09-18T16:24:39Z","snapshot_observed_at":"2026-07-06T13:16:01.925371Z","submitted_at":"2022-05-31T16:46:51Z","title":"Two-Dimensional Quantum Material Identification via Self-Attention and Soft-labeling in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15948","snapshot_observed_at":"2026-08-07T20:14:03.528698Z","title":"arXiv preprint arXiv:2205.15948 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.528698Z"},"links":{"cited_paper":"/paper/2205.15948","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:72e30bcd273cf0b5da5e3e47f3f6363a32ab7c921e94c994a066c4b218cc2f69","observation_id":"7a43ac72-4abf-4c73-bc86-4efbb972344c","resolution":{"observed_at":"2026-08-07T20:14:03.528698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-07T20:14:03.532719Z","title":"arXiv preprint arXiv:2106.08254 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.532719Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bb4c46c4b87afec6c163adb529c2719f08bee6a4f4a87e781654fdf0bb924c40","observation_id":"5abf39dd-5af0-4039-bf58-5c47a2fb3347","resolution":{"observed_at":"2026-08-07T20:14:03.532719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.597177Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"7c714785-aefa-4ab3-8d2f-7b661b14372d","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.537188Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:3db8084f11d5ad561d1d3791f29b699be5dd39f9563fc75bb9f982d00242cfd4","observation_id":"a88b83ca-c325-4ba4-98ce-7cc988e90335","resolution":{"observed_at":"2026-08-07T20:14:04.601052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.584341Z","title":"Neurocomputing 555, 126658 (2023)","venue":null,"work_id":"0405d6fb-32b5-4db2-8ef4-4babf2d5b3c1","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.541379Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0f26aef19868c93eacd41092c3b8d5c1c313dc831f85e309bc00e88a0a707020","observation_id":"1ed47745-0868-4cf4-bb40-c1bd298eaa06","resolution":{"observed_at":"2026-08-07T20:14:04.588650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10904","last_updated":"2022-05-15T23:20:46Z","snapshot_observed_at":"2026-08-06T05:59:00.316195Z","submitted_at":"2021-08-24T18:14:00Z","title":"SimVLM: Simple Visual Language Model Pretraining with Weak Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10904","snapshot_observed_at":"2026-08-07T20:14:03.546300Z","title":"arXiv preprint arXiv:2108.10904 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.546300Z"},"links":{"cited_paper":"/paper/2108.10904","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:e1c2bdfc4fbd3c5b4d2ef0c7d6835433b37ba1b8220e4923de881c48f990664a","observation_id":"8354bd25-586f-4f95-91f4-16e04aef353f","resolution":{"observed_at":"2026-08-07T20:14:03.546300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.571257Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":"7abeaa42-f2b1-4a11-913a-4d8d7c9fd6be","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.550647Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0f5be0fb78ff977af20fd491cb891479cd223df5105fabb9fdc06741631962d7","observation_id":"d4bed51d-cfdc-4070-87cb-f2531a1e8c05","resolution":{"observed_at":"2026-08-07T20:14:04.575636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.554535Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.554535Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ae2bb78f3500d9b993523193af0645f0eef7190b77f9e95999c0c06a90257679","observation_id":"8b52d5c1-2641-4de0-be20-31e2a79e7fef","resolution":{"observed_at":"2026-08-07T20:14:03.554535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15343","last_updated":"2023-09-27T12:05:41Z","snapshot_observed_at":"2026-07-06T15:08:30.190912Z","submitted_at":"2023-03-27T15:53:01Z","title":"Sigmoid Loss for Language Image Pre-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15343","snapshot_observed_at":"2026-08-07T20:14:03.559240Z","title":"arXiv preprint arXiv:2303.15343 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.559240Z"},"links":{"cited_paper":"/paper/2303.15343","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b7cfcf6482bd6c0c1250345b5c73cbe62e5c66c9aab49037d83199f72bfb16e2","observation_id":"642ee646-982f-416b-b8b2-1530e0ac351a","resolution":{"observed_at":"2026-08-07T20:14:03.559240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.552639Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":"2f16c39e-225f-46f7-99ab-a700c9d903c9","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.563519Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:52d755cff4fe6b8d8bf2b87c47d2d0717031baa8e7bc373df54f086ef93ded03","observation_id":"86bdca58-b3f7-4e08-a464-72aa6430ac95","resolution":{"observed_at":"2026-08-07T20:14:04.556691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14465","last_updated":"2023-10-09T16:55:08Z","snapshot_observed_at":"2026-07-06T15:07:56.586673Z","submitted_at":"2023-03-25T13:22:56Z","title":"Equivariant Similarity for Vision-Language Foundation Models","version":2},"cited_work":{"arxiv_id":"2303.14465","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.14465","snapshot_observed_at":"2026-08-07T20:14:04.056943Z","title":"Equivariant Similarity for Vision-Language Foundation Models","venue":"cs.CV","work_id":"b6c93a9c-fd37-4076-b924-3778a30a72c3","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.567690Z"},"links":{"cited_paper":"/paper/2303.14465","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:27f8e6a0db1a0076a10d69e26cea0cab8ccf254a690b655db525a2ee8d602abc","observation_id":"32c94a68-f7c5-4f3a-ad40-d73379e9ab65","resolution":{"observed_at":"2026-08-07T20:14:04.062223Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03384","last_updated":"2024-07-20T07:17:00Z","snapshot_observed_at":"2026-07-06T17:55:36.748672Z","submitted_at":"2024-04-04T11:33:29Z","title":"LongVLM: Efficient Long Video Understanding via Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03384","snapshot_observed_at":"2026-08-07T20:14:03.572391Z","title":"arXiv preprint arXiv:2404.03384 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.572391Z"},"links":{"cited_paper":"/paper/2404.03384","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bd3f67d3eb40d3fb8285c94002fd733bde1df04f6dd77017543337957389b468","observation_id":"161c47bc-0c0b-41e8-80e6-744bf84cd65a","resolution":{"observed_at":"2026-08-07T20:14:03.572391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.541147Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"62bf42cc-7ca7-45d6-be15-3598e0a7e4d3","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.577128Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b248c4232d1a5e165783fe2a8b8f52bbc3328bb0863bbe78f621a1815af6e244","observation_id":"582fc1dd-90c0-4090-8d39-1f72238bde31","resolution":{"observed_at":"2026-08-07T20:14:04.545159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11255","last_updated":"2024-12-09T16:15:07Z","snapshot_observed_at":"2026-07-06T16:49:33.776407Z","submitted_at":"2023-11-19T06:50:52Z","title":"M$^{2}$UGen: Multi-modal Music Understanding and Generation with the Power of Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11255","snapshot_observed_at":"2026-08-07T20:14:03.581263Z","title":"arXiv preprint arXiv:2311.11255 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.581263Z"},"links":{"cited_paper":"/paper/2311.11255","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bf2cedd1a25b6af77a7767ca6b54198fb957744cdb0510418696732eca44e2cc","observation_id":"d2c250f6-5c41-4c7e-bc80-741c6dc3529e","resolution":{"observed_at":"2026-08-07T20:14:03.581263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13731","last_updated":"2023-05-29T12:09:08Z","snapshot_observed_at":"2026-07-06T15:20:25.388057Z","submitted_at":"2023-04-24T07:45:28Z","title":"Text-to-Audio Generation using Instruction-Tuned LLM and Latent Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13731","snapshot_observed_at":"2026-08-07T20:14:03.585698Z","title":"arXiv preprint arXiv:2304.13731 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.585698Z"},"links":{"cited_paper":"/paper/2304.13731","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:731a93a85f3f37837dc3d34384e6684b516d4fb710fb0b4e95304e389c3338a7","observation_id":"67958216-8203-4b5c-bd0c-bd450947469c","resolution":{"observed_at":"2026-08-07T20:14:03.585698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.528664Z","title":"In: Forty-first International Conference on Machine Learning (2024)","venue":null,"work_id":"ca61f039-e3d3-482b-a15e-a1a5cf82f5a5","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.590003Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:c1dfc48e277917ddf2da918484dd829e4bd97f4162e226f48e1956279acdcf78","observation_id":"b6d1d44f-d302-4645-b348-936cdee20751","resolution":{"observed_at":"2026-08-07T20:14:04.533378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.516566Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"e13f9848-9a37-4eda-bccf-d7ee9628c591","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.594254Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:fce21155db2d3c6878aae91c2a56bb6128c6e995a089f2687aefbd7e40f31f9b","observation_id":"200dca4e-fc58-46f6-9a94-fcbb67aaa3f6","resolution":{"observed_at":"2026-08-07T20:14:04.520773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.503855Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"f91eab89-8a69-48ec-9a05-52841909a13d","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.598138Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a0673319008daf46886690417961747e8b10241cbca6116daee843e8ad811d28","observation_id":"8f6c6d70-3e65-44df-bd24-53fd20099a84","resolution":{"observed_at":"2026-08-07T20:14:04.508061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.492371Z","title":"In: The Thirty-eighth Annual Conference on Neural Information Processing Systems (2024)","venue":null,"work_id":"a99202eb-4a63-4f80-ab73-fe7b4256e94c","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.601936Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7bf2a2f007d6b3df2868a16d5496c526192c017a773dab220105d05b5e110e11","observation_id":"897f8c92-e513-4537-84fe-21a8adad5eeb","resolution":{"observed_at":"2026-08-07T20:14:04.496417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.480274Z","title":"CoRR (2024)","venue":null,"work_id":"1abddf6e-01aa-4259-8dad-ee77626c5a8c","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.605957Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:542fc7b655f0ae854e1a479ec227aeeafbc41c5603a4bbc02afa133310875572","observation_id":"c622d869-1810-4521-b96f-76c52711a8d5","resolution":{"observed_at":"2026-08-07T20:14:04.484369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.468384Z","title":"In: Proceedings of the International Conference on Machine Learning, pp","venue":null,"work_id":"14e68dcb-77e7-4098-afcb-1e9e804cd3d0","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.609938Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:8a04478fc331172a8c4e7b5ef49d815ce9b8b29dc3883cdfe5e5bb4a4d709bb6","observation_id":"574b456c-475c-4b67-b341-7e3e1cd21c5f","resolution":{"observed_at":"2026-08-07T20:14:04.472555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.454186Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"f73c09fc-fd37-4c06-a67b-0636165e3e7b","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.613777Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f16014fdb6b922e190debd385690eaaba91fd015a5be61bbb9214630fdf95c81","observation_id":"592462bf-1bb1-4fb9-b3c0-84dea7de25f3","resolution":{"observed_at":"2026-08-07T20:14:04.459548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.17126","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.996438Z","title":"arXiv preprint arXiv:2406.17126 (2024)","venue":null,"work_id":"0b846621-a6b8-4873-8883-8dc3e874bf05","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.617630Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:632f80c47957db6672dc6c4759dea7c442ad76653b017203ba0ac13690c8e513","observation_id":"eb652122-9dec-4c93-a967-31844d1630a7","resolution":{"observed_at":"2026-08-07T20:14:04.003496Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T20:14:03.621496Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.621496Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f7290f2b4309d26d896dc98dd9c499df21fedcf0cb6e48d706edf87f421b71a4","observation_id":"070dc3b6-422a-42ee-9df5-bdde0504d3f4","resolution":{"observed_at":"2026-08-07T20:14:03.621496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T20:14:03.625538Z","title":"arXiv preprint arXiv:2407.21783 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.625538Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:da66b36b0e95c9edbe208baa1089cf78b3dbf588a893b5b18d6599c10c60aa4b","observation_id":"e9182a25-21a3-4958-9218-d948af5673f7","resolution":{"observed_at":"2026-08-07T20:14:03.625538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.442293Z","title":"https://lmsys","venue":null,"work_id":"b0abea90-5e8c-44ee-9c26-2560e11a0e5d","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.629514Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1127560e16ba26f499733a1f00affd97f362593095c78d5e381bf1a2c13d5714","observation_id":"7ed24c0c-a9cd-4bac-91ee-d780eaf15cae","resolution":{"observed_at":"2026-08-07T20:14:04.446296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.430551Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":"f06816af-0ab4-4b90-8496-83b8e69c4e10","year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.633267Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ea6ccf5bd0148bbe0729487e5bbab3e47db4eb5bb8f0077594947f8945410a21","observation_id":"98ff88bf-5520-4493-8176-e7bbb2f83a52","resolution":{"observed_at":"2026-08-07T20:14:04.434532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T20:14:03.637273Z","title":"arXiv preprint arXiv:1810.04805 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.637273Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:db0cc3127b4bf0d775691d0d6e818d38d9397ebf4d5a76f42361329b561964c7","observation_id":"16d22215-91a3-4474-b89b-9d5aa161b86d","resolution":{"observed_at":"2026-08-07T20:14:03.637273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T20:14:03.641330Z","title":"arXiv preprint arXiv:1907.11692 (2019) 37","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.641330Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:dc88bc4b815d8fef879548c1a08eb836ea49976f9446d63d6cb07b076300c09b","observation_id":"6603f105-db56-4e5d-b2b6-7e3b358047a1","resolution":{"observed_at":"2026-08-07T20:14:03.641330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-07T20:14:03.645396Z","title":"arXiv preprint arXiv:1910.13461 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.645396Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:8999c9f9e247edec350b6b515959c48294c0d5d588fc44eea715c153b940f313","observation_id":"d2f3e40d-5857-4eb8-a846-b4d5683a2e18","resolution":{"observed_at":"2026-08-07T20:14:03.645396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.417962Z","title":"The Journal of Machine Learning Research 21(1), 5485–5551 (2020)","venue":null,"work_id":"9630d141-03d9-4458-92cb-847660a8d4ce","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.649319Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b6fa7f1f3e8e94c767552a1fd49bd1253a4ce94616eea36d2af90b4f63df360b","observation_id":"85238194-590d-48e3-bf1c-4ef3c8f58eca","resolution":{"observed_at":"2026-08-07T20:14:04.422533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.405216Z","title":"In: The 36th Conference on Neural Information Processing Systems (NeurIPS) (2022)","venue":null,"work_id":"210481c6-a3a2-4eb9-9a52-bb46e93726bb","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.652991Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:4bf58c4118436e864e560a50ba0979ed6962a570f8b850ec43333bdad60b8cde","observation_id":"7f79209d-9632-4306-936b-816f94c831b6","resolution":{"observed_at":"2026-08-07T20:14:04.409160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.656494Z","title":"In: Computer Vision–ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6-12, 2014, Proceedings, Part V 13, pp","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.656494Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:8568230760348ea9a3609f6f9ee070b38c1b96cf1fc238b494dba1a3d01a3bc9","observation_id":"a91d7833-9a26-486d-8382-5ad0749360d8","resolution":{"observed_at":"2026-08-07T20:14:03.656494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T20:14:03.660620Z","title":"arXiv preprint arXiv:2010.11929 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.660620Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a2e711493defd5cbc6557f0d2f68d39778ce336ec2b1260e842b66c5e4e7cea5","observation_id":"87fe93ee-a9c7-4f1f-9747-2a666074f691","resolution":{"observed_at":"2026-08-07T20:14:03.660620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.665008Z","title":"Advances in neural information processing systems 32 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.665008Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:cb3d7cf107ec9b9fe91970ee74eeee1cdfabc9e8f028495c1002332af60cda8b","observation_id":"8ad4aefc-1360-452b-89ab-1c30a59765fe","resolution":{"observed_at":"2026-08-07T20:14:03.665008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-07T20:14:03.669260Z","title":"arXiv preprint arXiv:1608.03983 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.669260Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:2e897d224149fcd82639e4416a69ba612c2bca007f01357a1bf39ac245fdff50","observation_id":"585bcfba-6127-4287-99e4-9c8c7d4b0359","resolution":{"observed_at":"2026-08-07T20:14:03.669260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T20:14:03.672971Z","title":"arXiv preprint arXiv:1711.05101 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.672971Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:929fd470565f7b4b22726f785ba51716d62a90c43bb601dc77e461324a29e39b","observation_id":"7c3fe678-de6f-4ae0-9604-093baa1f19b0","resolution":{"observed_at":"2026-08-07T20:14:03.672971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.377950Z","title":"Ecological Informatics 57, 101089 (2020)","venue":null,"work_id":"c99f4923-e6b4-40c8-9b45-f35af079575d","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.676820Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f6464bfe82ae1b543684d3a4479c07dfb4820aecdfcee06276879764935a0214","observation_id":"20362330-ac9a-4890-993a-c9c13e99d4eb","resolution":{"observed_at":"2026-08-07T20:14:04.382623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.365699Z","title":"Computers and Electronics in Agriculture 179, 105809 (2020)","venue":null,"work_id":"c3620ad2-32b3-47d7-8046-9f3e86b345e3","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.680409Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:be8ac96e87031db43176b11c5303b5f4b7fa93919dca2785bf9ad4e032bf0fb7","observation_id":"a38f9ea5-5cab-4941-8e41-4ec10a5b3816","resolution":{"observed_at":"2026-08-07T20:14:04.369454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.354181Z","title":"Advances in Neural Information Processing Systems 36 (2024) 38","venue":null,"work_id":"616ae6fa-9131-4301-bd18-43c8e66ecb8d","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.684817Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:369279d555c2294c785f66f70f324e6c8f6adcd47c6e4f994ab7c65ae35a75b4","observation_id":"71235bfb-490d-43a1-b39e-e0ad895aa6a7","resolution":{"observed_at":"2026-08-07T20:14:04.358652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.342980Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"b6037dbf-05ed-4411-bdf4-bdebe075ae4b","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.689192Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:3a640acac2001dd1d5f02918e2fdd668b0e393e4008bf0eaad993e9e7e330a0b","observation_id":"09d034ec-e1d5-4a82-8f2c-785706d91386","resolution":{"observed_at":"2026-08-07T20:14:04.346597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.331235Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"6409c710-cc01-4a47-ad9c-f3741088d981","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.693354Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:821f9d87741ede8052f7ceb3ba418defac3066849ef3b3405ae13e11247357f8","observation_id":"efa211a4-88e4-433b-bf97-a544a45202bd","resolution":{"observed_at":"2026-08-07T20:14:04.335292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.319518Z","title":"Advances in neural information processing systems 25 (2012)","venue":null,"work_id":"eba42c9a-5e10-4755-a0d9-299851b240fd","year":2012},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.697682Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:8d0bcb82e125683cfb76c789f9c205ff14053cbccb85bf4118545d54454ce971","observation_id":"e3a6f0e1-a677-456a-95ed-91b27553c8c8","resolution":{"observed_at":"2026-08-07T20:14:04.323380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.701689Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.701689Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a33fbbd00cc68c32cdf8cc7b776de0e7725c9b924cac5418554f908fa7487f90","observation_id":"435d2fe2-f715-424f-8401-0fd417eef4d7","resolution":{"observed_at":"2026-08-07T20:14:03.701689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-07T20:14:03.705597Z","title":"arXiv preprint arXiv:1409.1556 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.705597Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ec5608d3f9e47e446a8d7bed9f7528962147fe0741dcaa24359fd30b43b0e64d","observation_id":"c7f58662-8ffc-4853-baa9-37a54daa6074","resolution":{"observed_at":"2026-08-07T20:14:03.705597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.709995Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.709995Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:43d74935c06fd986def3f29e2293e8527632fd4e7e702f2dbd2ac6f37fca4724","observation_id":"90bafd51-0017-45c0-b8bf-691396cd3a62","resolution":{"observed_at":"2026-08-07T20:14:03.709995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:05:12.566543Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":63,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":105},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 105 outbound references and 1 inbound Pith citation observation for arXiv:2502.09906."}