{"as_of":"2026-08-01T11:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:608d944734f982622bacafb079d9461cbe93d118d688431756e93b6af9c0e99b","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T10:31:05.743053Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-01T06:32:01.292127+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T14:44:32.242554Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T14:44:59.711636Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2603.14882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.14882","snapshot_observed_at":"2026-07-08T14:44:59.711636Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","venue":"cs.CV","work_id":"b203f4f8-87e9-451b-9d62-7fb164b5f2d8","year":2026},"citing_paper":{"arxiv_id":"2605.25343","last_updated":"2026-05-25T01:57:43Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:57:43Z","title":"Toward Native Multimodal Modeling: A Roadmap","version":1},"reference_index":261,"source":"pdf_text","source_observed_at":"2026-06-29T22:58:38.610609Z"},"links":{"cited_paper":"/paper/2603.14882","citing_paper":"/paper/2605.25343"},"observation_digest":"sha256:1c0620f51e20fe240c66b5770992ab51f7b6654220055f87409643baa34bc362","observation_id":"bc148bdd-efd0-49e6-9c82-564e8ed3f352","resolution":{"observed_at":"2026-06-29T23:04:01.864944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2603.14882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.14882","snapshot_observed_at":"2026-07-08T14:44:59.711636Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","venue":"cs.CV","work_id":"b203f4f8-87e9-451b-9d62-7fb164b5f2d8","year":2026},"citing_paper":{"arxiv_id":"2607.06165","last_updated":"2026-07-07T11:39:57Z","snapshot_observed_at":"2026-07-10T23:18:21.393684Z","submitted_at":"2026-07-07T11:39:57Z","title":"EAGOR: Embodied Reasoning in Omni-direction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-08T14:44:32.242554Z"},"links":{"cited_paper":"/paper/2603.14882","citing_paper":"/paper/2607.06165"},"observation_digest":"sha256:e33ca86a7548b2a8c598668726b4bea9974319068365d948f978972d3834ace2","observation_id":"2ca7f7bd-a232-4a5d-b24c-c506c11375b3","resolution":{"observed_at":"2026-07-08T14:44:59.712899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.14882/citation-record","integrity":"/paper/2603.14882/integrity","json":"/paper/2603.14882/citation-record.json","paper":"/paper/2603.14882"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data augmentation with noise and blur to enhance the performance of yolo7 ob- ject detection algorithm","venue":null,"work_id":"387ea71a-36de-4a5f-a8ae-ba5e68277207","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:c51f3ba992af813900bd3b2f91610796c3b30d0de59ffbcf8336900080632dcb","observation_id":"c32950ae-fa91-4131-b677-39c5bb600aff","resolution":{"observed_at":"2026-05-15T10:39:57.694263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object detection through search with a foveated visual system.PLoS com- putational biology, 13(10):e1005743","venue":null,"work_id":"639914e6-6564-4908-b376-5b7adf535a42","year":2017},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:0713107a15e906e1eb77b4f10b5fc4f6647b9053dfdba4d8035fae62c609bc6c","observation_id":"648f6afc-2a75-4370-afd1-7968eab41f11","resolution":{"observed_at":"2026-05-15T10:39:57.731196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736","venue":null,"work_id":"39acf795-5cf8-436e-9263-403289f4a06c","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:0ef94ebf61b4a4f422c1cb9d82034b33f2e71243c5739b5bb7ad1f65190b145d","observation_id":"98835792-3e93-48f2-889e-9ae8bbf9883e","resolution":{"observed_at":"2026-05-15T10:39:57.734642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M ¨obius trans- formations revealed.Notices of the American Mathematical Society, 55(10):1226–1231","venue":null,"work_id":"2fb9cedd-d403-49d3-a6fb-c666dfa8ec8f","year":2008},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:9173448d56e7b9bd6fd6f6ff8d516d0322babe9dafa7052e320d785f7dff9069","observation_id":"1dc8fe82-bf2c-473a-b38b-23e5989aab5d","resolution":{"observed_at":"2026-05-15T10:39:57.737928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-07-11T01:17:45.013705Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:4219b7ab2cb4b0f1a04037925da4a19452875bd0e3f502f7fa7e02cc793ecbf0","observation_id":"f4ae511c-044a-404e-be6e-f055bedf5d7f","resolution":{"observed_at":"2026-05-15T10:35:27.643584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A summary-statistic representation in peripheral vision ex- plains visual crowding.Journal of vision, 9(12):13–13","venue":null,"work_id":"7ecaa990-83c2-4820-81cc-233757e22078","year":2009},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:8090ab0c0d071b6e499ffc86cc078efca29eadf69ee5290a2e81335a131d63af","observation_id":"0ffaac07-16ee-4144-bc56-e27e8abf039d","resolution":{"observed_at":"2026-05-15T10:39:57.744724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-07-06T14:06:56.291161Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":"2210.09461","doi":"10.48550/arxiv.2210.09461","metadata_source":"pith","pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Token Merging: Your ViT But Faster","venue":"cs.CV","work_id":"528509bc-2611-4e7f-a772-ea14d25b6dae","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:111c09e3e6e6d000d22210e3d808a0c540302f8d87b40ec270effe04bb69a721","observation_id":"1fb6bdf0-2b41-4cb2-a621-8e85202e8e35","resolution":{"observed_at":"2026-05-15T10:35:27.626152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A general survey on attention mechanisms in deep learning.IEEE transactions on knowledge and data engineering, 35(4):3279–3298","venue":null,"work_id":"77fa4a0a-3724-46bf-8d19-c713b86f7fd0","year":2021},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:017b9a37d442a8c76452eb0b451e8c9bed7bbb3d89d4df55e234b8421b206d34","observation_id":"bf716ec9-bd95-46e7-8e6d-d5420f1b131b","resolution":{"observed_at":"2026-05-15T10:39:57.727690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convolutional neural networks develop ma- jor organizational principles of early visual cortex when en- hanced with retinal sampling.Scientific Reports, 14(1):8980","venue":null,"work_id":"9f648215-87f5-4e6e-82da-84a28523d7c7","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:44b07893409a08266b2bb011404cd9cbeefb7550840fe06d55f23a256f08f540","observation_id":"27e13e15-c2fa-4f89-98ca-3ecb3745ca7b","resolution":{"observed_at":"2026-05-15T10:39:57.741300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructblip: Towards general-purpose vision- language models with instruction tuning.Advances in neural information processing systems, 36:49250–49267","venue":null,"work_id":"e0e9c2ed-7f40-4152-b2a6-f111f525427e","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:13b103ea3e6318fe56039806e508bd9cfc326f058940072f7385a66e3067c4c2","observation_id":"f9619b07-9ced-4ece-a261-43bc2bfd7a9f","resolution":{"observed_at":"2026-05-15T10:35:28.672840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The representation of the visual field on the cerebral cortex in monkeys.The Journal of physiology, 159(2):203","venue":null,"work_id":"b7e414a7-b165-4d92-b36c-e405a4366320","year":1961},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:393adfbe299bd70244d50470e16ab435bbf6461bf12b02aee71c07eb73d11e98","observation_id":"e38eead7-ab86-4145-8ce8-c03db7705e70","resolution":{"observed_at":"2026-05-15T10:35:28.674871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PhD thesis, Indian Institute of Technology Gandhinagar","venue":null,"work_id":"e72dcd26-523c-44e7-a190-7c9f6bb7f563","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:553b336807f091d760c4864d7f6a5553b015c8430bc496ab624a0734e94e903f","observation_id":"836cf222-4930-47d3-b85f-1eeb032470f2","resolution":{"observed_at":"2026-05-15T10:35:28.668644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Modified harris hawk optimization algorithm for mul- tilevel image thresholding","venue":null,"work_id":"c83d45d8-f8fd-4f34-a727-45f51afb506d","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:9013dcabccf29cae2dfe1b52360f51e8f0088f1d230a92ad964edf6a58f6c44c","observation_id":"9bd20661-793f-4b0d-989c-b17dfc2dee5d","resolution":{"observed_at":"2026-05-15T10:39:57.747620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scribgen: generating scribble art through meta- heuristics","venue":null,"work_id":"2ba75466-1cbf-49c5-a359-ba045335cb86","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:3da341fdae281a94b4b97e4252ae712e0110cfba6c0c635b9615bf040efc46e5","observation_id":"29105450-b676-4f6f-bd49-ff593144082d","resolution":{"observed_at":"2026-05-15T10:35:28.666373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07991","last_updated":"2021-06-22T21:21:08Z","snapshot_observed_at":"2026-07-06T09:28:59.431672Z","submitted_at":"2020-06-14T19:34:44Z","title":"Emergent Properties of Foveated Perceptual Systems","version":3},"cited_work":{"arxiv_id":"2006.07991","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07991","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emergent proper- ties of foveated perceptual systems","venue":null,"work_id":"f48abe65-becf-40de-9f10-d3ea1c582c4d","year":2006},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2006.07991","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:d8e233a071337c6dac654c209c26e6e816056217919de0555c28505549af3366","observation_id":"f520765a-c60f-4bcf-9cfd-94736ae05b6e","resolution":{"observed_at":"2026-05-15T10:35:27.617377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Image quality assessment: Unifying structure and texture similarity.IEEE transactions on pattern analysis and ma- chine intelligence, 44(5):2567–2581","venue":null,"work_id":"a0965a49-3edf-442a-91c3-feb917c56270","year":2020},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:b513849e7699004aadcca6796801e9144e262fa8703f14111fbcb94a6e4a5398","observation_id":"4d725512-2d7f-40e7-a844-d7a0cf57d081","resolution":{"observed_at":"2026-05-15T10:35:28.676882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Selective attention and the organization of vi- sual information.Journal of experimental psychology: Gen- eral, 113(4):501","venue":null,"work_id":"5c3650a1-28df-4c56-871d-bc767a8d0067","year":1984},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:613e1afd5bdf2ba13c8c37fa0e75bdff41ecb71ba6293a797ec59dd910c5127c","observation_id":"5413c99f-e089-4148-b28e-19f867774949","resolution":{"observed_at":"2026-05-15T10:35:28.681103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metamers of the ventral stream.Nature neuroscience, 14(9):1195–1201","venue":null,"work_id":"24a2f341-e897-4317-9de3-d9f062fa2c04","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:e97f8ed2dbe2a1062ca144e71dcce3282857d8195ebfa2699147b9de6ec6b643","observation_id":"5b736cc7-cc00-46f2-8146-f9de1e5efb70","resolution":{"observed_at":"2026-05-15T10:35:28.661486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The free-energy principle: a unified brain the- ory?Nature reviews neuroscience, 11(2):127–138","venue":null,"work_id":"2c6fa31b-9de8-4b99-a1e9-da26278dc9a3","year":2010},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:db221a287e2567ba0832c5a0ea9c3f6c295533318546ce77332939b9e72d6653","observation_id":"c080502c-a7b0-4022-8eb0-79be1878c4b9","resolution":{"observed_at":"2026-05-15T10:35:28.659117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10516","last_updated":"2024-04-01T20:57:45Z","snapshot_observed_at":"2026-07-06T17:45:23.748539Z","submitted_at":"2024-03-15T17:57:06Z","title":"FeatUp: A Model-Agnostic Framework for Features at Any Resolution","version":2},"cited_work":{"arxiv_id":"2403.10516","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.10516","snapshot_observed_at":"2026-07-04T10:19:47.772835Z","title":"Featup: A model- agnostic framework for features at any resolution","venue":null,"work_id":"e8f8c9b1-89ad-4c27-a3f4-dc6df53ca77d","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2403.10516","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:f81f2cb19de7408d0334ec845a15fca432d2d1066cf3bdc1617611d71c927606","observation_id":"ed7dd5ed-17e5-4800-a57c-90329ed1a442","resolution":{"observed_at":"2026-05-15T10:35:27.608930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mini-internvl: a flexible-transfer pocket multi-modal model with 5% parameters and 90% perfor- mance.Visual Intelligence, 2(1):32","venue":null,"work_id":"0773d437-b706-428b-8fca-7e08206d25e0","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:3e9eb8bcd6d25359f046fa6a01b408fc0133cd0ae55bc4e24617a7dcca043446","observation_id":"749041e1-ea54-4138-ba47-b955f65917e9","resolution":{"observed_at":"2026-05-15T10:39:57.762710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vari- able resolution improves visual question answering under a limited pixel budget","venue":null,"work_id":"4c54a5c9-05a4-4a0e-b93e-e1f73d24eb18","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:187e6b1fd110e731f62b5d71826bb853535bdf9e8d2b370d9e3e8c919b280250","observation_id":"52dbf0eb-e94f-4dd0-bd72-c73bb32557bf","resolution":{"observed_at":"2026-05-15T10:35:28.650273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"See- ing more with less: Human-like representations in vision models","venue":null,"work_id":"a2e3cc81-d8b5-4be8-92fb-56e534ca6a51","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:7e001030e90fa0389370237bae96dbca1ca81842677f2a612149451e9183b848","observation_id":"990b23ff-9a13-40d3-bd34-b84cd34ab078","resolution":{"observed_at":"2026-05-15T10:35:28.654698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answer- ing","venue":null,"work_id":"546a793f-3348-446f-820d-094aef779344","year":2017},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:b626133ea47e130c0e803a66586fa0d9e1ce1a5461e1b7e0233af613b8b1e59a","observation_id":"07a056aa-f506-4a0a-9fdc-862517fda58c","resolution":{"observed_at":"2026-05-15T10:39:57.713950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lvis: A dataset for large vocabulary instance segmentation","venue":null,"work_id":"5651726c-eb27-4242-83c4-899ecab34841","year":2019},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:4a9e9427cb1769d6c0378e772d69efa0069b2fb732f67ebfaef4929d8fdb9d19","observation_id":"0466e7cf-1a37-4ca0-a7a6-6f679a77bec9","resolution":{"observed_at":"2026-05-15T10:35:28.646080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on vision transformer","venue":null,"work_id":"18e6a2a7-24da-48ae-b12d-82387e49a67a","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:e78e35e5660b6eb7d6773cc9dca01ca465eba06ba819f70eb10e0a0a9f222cc5","observation_id":"a5c62fa2-5f0a-4ae3-b774-f519f8053f40","resolution":{"observed_at":"2026-05-15T10:35:28.643977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coco-periph: bridging the gap between human and machine perception in the periphery","venue":null,"work_id":"19e8ec0b-af03-4f7b-b4a1-c859c783b85a","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:60c7aeeb94ad2bf2c0366d00d66dddf1fe581af62005e241fc622b549c30b714","observation_id":"82eb9942-4941-40b6-9882-1069f6e1fec9","resolution":{"observed_at":"2026-05-15T10:35:28.648058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eye movements in natural behavior.Trends in cognitive sciences, 9(4):188–194","venue":null,"work_id":"444e39bc-2d90-48ea-851b-084ffe6443d5","year":2005},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:fce36d91f33027a9a32a70b62fb948bc263bdeefed231c57c502efb9d2c75b7b","observation_id":"14c681cd-a103-4d04-a332-dac975a1aea9","resolution":{"observed_at":"2026-05-15T10:35:28.652701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vi- sual prompt tuning","venue":null,"work_id":"a931f630-8d23-4711-858d-13e3f3bed386","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:bb351db7eafbfc7e4bdc37fa583a4b78294d688c3b1c441c41bf4a2e13dce19c","observation_id":"79981c56-12b0-4e38-9522-7e19687406cb","resolution":{"observed_at":"2026-05-15T10:35:28.642204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transformers in vision: A survey.ACM computing surveys (CSUR), 54(10s):1–41","venue":null,"work_id":"87ee5798-f743-438b-8811-a403ee8318ec","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:8efc2cf9dc4cea9e8dbefb87f9ab1f8d946afadf7ba8f1c7c5b5e662bec95b31","observation_id":"929a1275-463c-42d0-9969-634425b509b0","resolution":{"observed_at":"2026-05-15T10:35:28.640412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01450","last_updated":"2023-12-03T16:48:09Z","snapshot_observed_at":"2026-08-01T01:50:20.876210Z","submitted_at":"2023-12-03T16:48:09Z","title":"Foveation in the Era of Deep Learning","version":1},"cited_work":{"arxiv_id":"2312.01450","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.01450","snapshot_observed_at":"2026-07-01T22:26:17.680591Z","title":"Foveation in the era of deep learning","venue":null,"work_id":"65b42d6c-f8f6-48bb-94d5-947897f21466","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2312.01450","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:ba4bb1f468ac990aaf0bf7c646a8dc02301c01e4434439051703f9d3b0af32dd","observation_id":"d99382e1-c4b5-440e-8e40-64155488d60f","resolution":{"observed_at":"2026-05-15T10:35:27.662926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Oxford Uni- versity Press","venue":null,"work_id":"ec0163f9-8179-42f2-8917-e0a1d3c6b6d5","year":2009},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:557b57d9d7d48cd422bbbe291d8abea6e16f6109ec7939d3f97d2dc017ede67d","observation_id":"d122a807-d21f-4a6a-bf84-9729c95af1f8","resolution":{"observed_at":"2026-05-15T10:35:28.670665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2307.16125","doi":"10.48550/arxiv.2307.16125","metadata_source":"pith","pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","venue":"cs.CL","work_id":"23881ff0-b851-474c-8712-90744cc07a3a","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:ba45a104326f98195bddc02b4575054ada2d05e7ef9152dd5e6871b802c7ee68","observation_id":"7ca8e6f7-f59b-4d3c-915e-01d66a709c4b","resolution":{"observed_at":"2026-05-15T10:35:27.613119Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-07-10T13:27:05.574543Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:d7bf0977dd0c347ff6b4bd175cb87650bf428e102f91997e10562cc3ccf3f41f","observation_id":"99321951-9ab3-4bcd-938e-2702b5060799","resolution":{"observed_at":"2026-05-15T10:35:27.647915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"0b67aebc-8de9-487f-b4cd-fd2663288141","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:50b8c49392488ed70da7028eab9402e03b1025cf601603ca7af29f6c1749a2c8","observation_id":"4cc72545-f925-4f5b-9606-645e278c9179","resolution":{"observed_at":"2026-05-15T10:35:28.638366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2403.05525","doi":"10.48550/arxiv.2403.05525","metadata_source":"pith","pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","venue":"cs.AI","work_id":"30da36a4-b9ad-4618-8955-c09232b61343","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:30dc8dd63dc0528deed8bdeefdba79cc05f62be084829c2c10b22c6da311b875","observation_id":"5063c342-afa5-446b-9dd7-63d8c0d2ed08","resolution":{"observed_at":"2026-05-15T10:35:27.621585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bio- logically inspired deep learning model for efficient foveal- peripheral vision.Frontiers in Computational Neuroscience, 15:746204","venue":null,"work_id":"f3254e3d-b8a2-4bfd-9af4-ce52aa97317b","year":2021},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:4a6b6ba3878f2e8a53fd9f05fd48acee9d5d9e417f001dbd9c3e4edccc96b79a","observation_id":"30e190e7-0b4c-42d4-871d-2a753af1ae27","resolution":{"observed_at":"2026-05-15T10:35:28.656836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09154","last_updated":"2025-09-11T05:23:22Z","snapshot_observed_at":"2026-07-06T22:28:33.382363Z","submitted_at":"2025-09-11T05:23:22Z","title":"Mind Meets Space: Rethinking Agentic Spatial Intelligence from a Neuroscience-inspired Perspective","version":1},"cited_work":{"arxiv_id":"2509.09154","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09154","snapshot_observed_at":"2026-07-08T14:44:59.715816Z","title":"Mind meets space: Rethinking agentic spatial intelligence from a neuroscience-inspired per- spective","venue":"cs.AI","work_id":"3b07272b-7eb9-49fd-81aa-79ee952f812c","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2509.09154","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:d76e6f9ff8057dbd6a4d0e58fac6a4a1d4aa8de132b9dda463b6afb925e439fc","observation_id":"7b332d7e-6c2c-4cf3-ab75-c75b15888d8c","resolution":{"observed_at":"2026-05-15T10:35:27.635083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05299","last_updated":"2025-04-07T17:58:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T17:58:57Z","title":"SmolVLM: Redefining small and efficient multimodal models","version":1},"cited_work":{"arxiv_id":"2504.05299","doi":"10.18653/v1/2025.acl-long.718","metadata_source":"pith","pith_arxiv_id":"2504.05299","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SmolVLM: Redefining small and efficient multimodal models","venue":"cs.AI","work_id":"810cc87f-f6bd-4443-9673-5e30982426b9","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2504.05299","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:7e0ef006ee6d0952f56dca208ce316ce47cd8cda87bd3698c293f3796b3f656e","observation_id":"a03270dc-468f-497d-95dc-4e01ce2af4d9","resolution":{"observed_at":"2026-05-15T10:35:27.604164Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peripheral vision transformer.Advances in Neural Informa- tion Processing Systems, 35:32097–32111","venue":null,"work_id":"3887646e-32b0-46e6-81fa-c88eb87362cc","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:e20ddb6f3a10e844af6e3857c18f932da634daf25bd01d37652eb510851d2437","observation_id":"3e1398e7-de42-4952-a76d-a94d53d1d51e","resolution":{"observed_at":"2026-05-15T10:35:28.664296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The geometry of m ¨obius transformations","venue":null,"work_id":"3ee45eb4-e2db-4fb9-92fd-0730be7274f9","year":2010},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:1dc76bbdb50d1f3ee0f1c3790bc01044c49a54f0fee2592c34ed982b310fd571","observation_id":"ff5e0932-77bb-4a0e-8bf0-8a36035ca3a8","resolution":{"observed_at":"2026-05-15T10:39:57.756118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to search for and detect objects in foveal images using deep learning","venue":null,"work_id":"f3dc4a82-0e85-4c5a-861b-03a37580fe29","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:640df231ceee4572914497988d60b449afeedc0ff93fd81eb3dd1345376337fd","observation_id":"5b08aeba-4620-41e4-a457-0e53e67a8a2f","resolution":{"observed_at":"2026-05-15T10:39:57.753523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human peripheral blur is optimal for object recognition.Vision research, 200: 108083","venue":null,"work_id":"ef1a54b1-89ed-4ed0-9fba-44bb8fd5756c","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:07b8dc34a28085f12fec0a3ba7d9f75126157d99727b4813805085184b1f8159","observation_id":"52f67fdc-44b3-4d3c-bb24-706a049ab5cb","resolution":{"observed_at":"2026-05-15T10:39:57.710594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:41:41.595118Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification.Advances in neural information processing systems, 34:13937–13949","venue":null,"work_id":"40b56994-c151-4f5d-b64c-0416c77175b6","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:b2bcb2b6f28ad5666228240e2d357d53029ac7ae2f8093acc032b370d43ad04a","observation_id":"a94cd915-bce3-4f97-b45c-40659c023607","resolution":{"observed_at":"2026-05-15T10:39:57.750484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Biologically inspired image sampling for electronic eye","venue":null,"work_id":"db52f70c-78d5-4d93-ace8-d3389b12a3a9","year":2010},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:ae1ef2aa6755b1e314802b132c5e7d0cd3685b595cc19ef5bc4f02a03a97f2e1","observation_id":"c74410da-f002-4040-a94e-d837bdc379a8","resolution":{"observed_at":"2026-05-15T10:39:57.723571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robotic materials with bioinspired microstructures for high sensitivity and fast ac- tuation.Advanced Science, 13(15):e09739","venue":null,"work_id":"7909207e-87a9-4ba8-9933-bfa26e47d9de","year":2026},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:047cd0d332872565717fa569b418a5c616cc3c0d4b9d9afea19e2782b0b4ee17","observation_id":"eaa78c98-22e2-47ad-9a4c-19cd4889d51e","resolution":{"observed_at":"2026-05-15T10:39:57.717368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A-okvqa: A benchmark for visual question answering using world knowl- edge","venue":null,"work_id":"f3c224e7-97ef-4ea7-b587-e0834689c263","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:20a6b92defb31609d946313f559e12f69b406a87178e3fc58b78945aab658ffc","observation_id":"0218b050-ffb4-4e88-b015-d151fb2e6cf9","resolution":{"observed_at":"2026-05-15T10:39:57.706937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.09093","last_updated":"2022-11-19T05:13:45Z","snapshot_observed_at":"2026-07-06T13:01:48.343142Z","submitted_at":"2022-04-19T18:57:47Z","title":"Behind the Machine's Gaze: Neural Networks with Biologically-inspired Constraints Exhibit Human-like Visual Attention","version":2},"cited_work":{"arxiv_id":"2204.09093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.09093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Behind the machine’s gaze: Neural networks with biologically-inspired constraints exhibit human-like visual attention","venue":null,"work_id":"6713fd2c-182d-4f08-bd03-2d6df355c3e8","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2204.09093","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:39358859c68e3c60238fbde7f7a671b5727ebbff7e0991e4e467c0e77798b244","observation_id":"d7534fa2-d532-452e-90a6-86752c1da381","resolution":{"observed_at":"2026-05-15T10:35:27.658311Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multivariate stochastic approximation using a simultaneous perturbation gradient approximation.IEEE transactions on automatic control, 37(3):332–341","venue":null,"work_id":"17064360-9ba8-424e-8cbb-ea32a2a44df5","year":2002},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:7d9b5433ed45e8a0df98db1eeb7fc93e1def9c46009640667fece1e9565e6fac","observation_id":"f3921aa6-5a35-43f5-ab29-7575a8922137","resolution":{"observed_at":"2026-05-15T10:35:28.678951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pe- ripheral vision and pattern recognition: A review.Journal of vision, 11(5):13–13","venue":null,"work_id":"e110f9a2-4af5-494a-9953-f4f2d5b42e42","year":2011},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:96950eebc6fbb26a9e2c23d9f5d2fb9c0939ce33ba259b65fd9da93af6ef8962","observation_id":"af1f6430-0ad6-415a-82e8-961a673bfa71","resolution":{"observed_at":"2026-05-15T10:39:57.759239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Central and peripheral vision for scene recognition: A neurocomputational model- ing exploration.Journal of vision, 17(4):9–9","venue":null,"work_id":"eb3a70d2-d4c0-49c6-8d0d-a695bfa6d984","year":2017},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:86a4e1c0677a4a96c1688f872cf474aa8354a6d4c1080dcdb6cbb57ac870af29","observation_id":"41923778-ee58-4d55-a2a5-73b6a9255a3f","resolution":{"observed_at":"2026-05-15T10:39:57.697699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-07-11T01:17:42.597062Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:dc8941c5edd8d0f186bdfe0893c07b557afb427e561d2ed12055e28722d39544","observation_id":"d9ea73e5-70da-456b-bb51-9e6a76e7037c","resolution":{"observed_at":"2026-05-15T10:35:27.630268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers.Ad- vances in neural information processing systems, 33:5776– 5788","venue":null,"work_id":"c0ad32e9-ae32-43cb-b2a4-07a1e372b82a","year":2020},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:1980110a69443258e31c77fff53c4e09bfedf588236ec9bc2c199c82af4844d1","observation_id":"88e62a00-72a6-4ce4-89da-d692cf9e9866","resolution":{"observed_at":"2026-05-15T10:39:57.720624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emulating human-like adaptive vision for efficient and flexible machine visual perception.Nature Machine In- telligence, pages 1–19","venue":null,"work_id":"a786870a-5f42-4fff-aef2-ceb18b21f2ea","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:2a21c239ffa3901b08788b2a99614c1af17338631605359074ca77df82276616","observation_id":"573345b3-4ac8-47be-95dd-b4a9928691c7","resolution":{"observed_at":"2026-05-15T10:39:57.703051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Controlmllm: Training-free visual prompt learning for multimodal large language models.Advances in Neural Information Processing Systems, 37:45206–45234","venue":null,"work_id":"d1c23c4b-a119-43e7-8e6b-6e826f7cc4b9","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:836e2a316a71951edd5cfa59491cc5b463eefc44b153f08965dd82d70fa8850f","observation_id":"01a0c6a9-d91f-4ce8-960d-4fdeeda6d0d8","resolution":{"observed_at":"2026-05-15T10:39:57.702339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:39b269b9fe0068ec69d624a64c8507e60f49b1380f9498a9060b821812376a3f","observation_id":"7cba3786-890d-45cd-ae9c-bc4f6b09d91e","resolution":{"observed_at":"2026-05-15T10:35:27.639521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07704","last_updated":"2023-10-11T17:55:15Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T17:55:15Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","version":1},"cited_work":{"arxiv_id":"2310.07704","doi":"10.48550/arxiv.2310.07704","metadata_source":"pith","pith_arxiv_id":"2310.07704","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","venue":"cs.CV","work_id":"0db2bf55-f649-4428-bcc9-688724b38e57","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2310.07704","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:8c2bc5b07acbfc938b287bb9af77685ecab48e41a8c1d50eb712afabf5f11223","observation_id":"ba856bf3-d05e-4a5b-8f09-33256ac6d2d3","resolution":{"observed_at":"2026-05-15T11:29:05.422888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vsi: A visual saliency-induced index for perceptual image quality assess- ment.IEEE Transactions on Image processing, 23(10): 4270–4281","venue":null,"work_id":"9993a25c-9701-44c8-b63d-9375f9599308","year":2014},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:f625535a839b670f70a200c33ea1f20a96d32ca34108e1fbf2b27ac0aee0881f","observation_id":"7e47f42b-2de2-4bdb-9986-2f98378a40c9","resolution":{"observed_at":"2026-05-15T10:39:57.685691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":44},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"thesis":"As of 1 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2603.14882."}