{"as_of":"2026-08-18T04:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a8791f2c42f0f019c4567bf2269d61e796bd1864f4484a8f61c38bf87e2abb81","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:22:18.156922Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.12637/citation-record","integrity":"/paper/2508.12637/integrity","json":"/paper/2508.12637/citation-record.json","paper":"/paper/2508.12637"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T17:22:17.941255Z","title":"Qwen technical report.arXiv preprint arXiv:2309.16609, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.941255Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:bd453d3b03b02a9d418991519496d9ee455a6344c253773767bc6e8670086847","observation_id":"959a7328-fad9-4a90-a01a-19f5411a3f21","resolution":{"observed_at":"2026-08-15T17:22:17.941255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-15T17:22:17.947927Z","title":"Qwen2.5-vl technical report.arXiv preprint arXiv:2502.13923, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.947927Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:0d3800ccc1b6191b0ae49429efffe4207edf1f636d833d7e29ff3c0c4232bce1","observation_id":"b7fdf63c-0a84-4f66-a4a5-d2d8e9baf7c0","resolution":{"observed_at":"2026-08-15T17:22:17.947927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.161486Z","title":"Ipn hand: A video dataset and benchmark for real-time continuous hand gesture recog- nition","venue":null,"work_id":"b352c42f-7e89-4e9d-9d62-0978d1145684","year":2020},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.953352Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:498995321fd0640f05911db417c46c83cd44c63cacdf8cf0975a0c18d575426b","observation_id":"172d9780-492b-4149-955c-a5ffe5f76e6a","resolution":{"observed_at":"2026-08-15T17:22:19.166531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.11027","last_updated":"2020-05-05T09:13:24Z","snapshot_observed_at":"2026-08-16T00:18:00.924587Z","submitted_at":"2019-03-26T17:19:56Z","title":"nuScenes: A multimodal dataset for autonomous driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.11027","snapshot_observed_at":"2026-08-15T17:22:17.959179Z","title":"Lang, Sourabh V ora, Venice Erin Liong, Qiang Xu, Anush Krishnan, Yu Pan, Giancarlo Baldan, and Oscar Beijbom","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.959179Z"},"links":{"cited_paper":"/paper/1903.11027","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:24f5e98ec4f42c325d1122da075cdab2c8bd76ec7eb0dcde4a41174d20e2d3be","observation_id":"384b3319-3ec9-4191-94a4-51fd616600fb","resolution":{"observed_at":"2026-08-15T17:22:17.959179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T17:22:17.965066Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.965066Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:2d3a6dfe579168cf351ab1b7858e1431049a6b6837b2017b560c31555461ce5b","observation_id":"57d71df5-3a37-4916-9833-a9cabdf85b4a","resolution":{"observed_at":"2026-08-15T17:22:17.965066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.146352Z","title":"Learn- ing a deep convnet for multi-label classification with partial labels","venue":null,"work_id":"73fff41c-d047-4b3f-9f77-923b1c1e1de4","year":2019},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.970697Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:e18021ea052b234a6e941890f361011efb68d288b94eae2674d161a2c4ee56b0","observation_id":"948bf6da-876b-40b6-a9b1-dc0cefa94cfe","resolution":{"observed_at":"2026-08-15T17:22:19.151287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.130147Z","title":"Notes-guided mllm reasoning: Enhancing mllm with knowl- edge and visual notes for visual question answering","venue":null,"work_id":"8121ffe4-7bb0-459f-b729-e2ab9b5b8d50","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.977267Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:269dfe85529414f7cf662a21c76f0ad0eead77e7dd67decaff0611476dd70afe","observation_id":"98247d09-5ac2-4692-a939-6e183c50e300","resolution":{"observed_at":"2026-08-15T17:22:19.135578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.16623","snapshot_observed_at":"2026-08-15T17:22:17.982994Z","title":"History-augmented vision-language models for frontier-based zero-shot object navigation.arXiv preprint arXiv:2506.16623, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.982994Z"},"links":{"cited_paper":"/paper/2506.16623","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:51b76a1ed88b706a0efb80dc09db4d2f851f9885a5dd4100909edf158cac3d47","observation_id":"28ed85db-802d-41e5-8563-183a2290d9eb","resolution":{"observed_at":"2026-08-15T17:22:17.982994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.112732Z","title":"Laecips: Large vi- sion model assisted adaptive edge-cloud collaboration for iot-based perception system.arXiv e-prints, pages arXiv– 2404, 2024","venue":null,"work_id":"e5c3ace6-0bf0-474b-9e64-8018d9da94b9","year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.988496Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:d33bbcd7b93e375a3750c325c49c81eb3d2840f2c767371033165a0ce1b556fe","observation_id":"58d17876-6448-44df-bcc1-654b4a031d6d","resolution":{"observed_at":"2026-08-15T17:22:19.118216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.096290Z","title":"A cloud-edge collaborative architecture for multi- modal llms-based advanced driver assistance systems in iot networks.IEEE Internet of Things Journal, 2024","venue":null,"work_id":"bbcc456f-8667-406a-a7f5-a56cb80b8eb6","year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.993664Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:f4129e64ef8b9d0c188b60c30258089df312d72279e756a79fb49bcfe0e3fbdf","observation_id":"362de522-1084-4447-bfcd-9c3c488ce399","resolution":{"observed_at":"2026-08-15T17:22:19.101599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.076652Z","title":"Multi-label classification by exploiting local positive and negative pairwise label correlation.Neurocom- puting, 257:164–174, 2017","venue":null,"work_id":"001974c9-e821-472c-bb9d-b125c96c6756","year":2017},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.999012Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:94788c89de676ad09b735744061c3325e535808aa68eaf3ca2b2e3950fc18b5f","observation_id":"a0c40338-26a0-48ad-9d6e-0e3a46687ac0","resolution":{"observed_at":"2026-08-15T17:22:19.082928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21080","last_updated":"2024-12-30T16:57:05Z","snapshot_observed_at":"2026-08-16T22:23:33.828463Z","submitted_at":"2024-12-30T16:57:05Z","title":"Vinci: A Real-time Embodied Smart Assistant based on Egocentric Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21080","snapshot_observed_at":"2026-08-15T17:22:18.003982Z","title":"Vinci: A real-time embodied smart assistant based on egocentric vision-language model.arXiv preprint arXiv:2412.21080, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.003982Z"},"links":{"cited_paper":"/paper/2412.21080","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:e318d1607abdfddbe39522aa056676557f5db2d616624cfd9e6aa3de0948b4cf","observation_id":"cc83a24a-8b7e-4524-a336-880097fe8413","resolution":{"observed_at":"2026-08-15T17:22:18.003982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-15T17:22:18.009072Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.009072Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:5426f623a9630160ddba3481e0a6cabbc9043f2242b8c882c2626a25bee1d5a1","observation_id":"3a361aa2-f2f0-48a8-b13e-5032f5bbfde8","resolution":{"observed_at":"2026-08-15T17:22:18.009072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.014571Z","title":"In-context learning can perform continual learning like humans.arXiv preprint arXiv:2509.22764, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.014571Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:25ab5b72ac99eaae7af78c4685855c7ca36a0ef90ef9410d37a63fd95e9d1cec","observation_id":"7616c9e4-a50f-43ca-a65a-52116844537d","resolution":{"observed_at":"2026-08-15T17:22:18.014571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.058892Z","title":"Generative planning with 3d-vision lan- guage pre-training for end-to-end autonomous driving","venue":null,"work_id":"eeaac5d8-3e6f-46aa-b4fd-c3e7d03e5885","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.019586Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:13c48e10701d22154761f8c5b67fdcd4c8e674fa46c25fe7449e7d50a739e828","observation_id":"09148eba-f478-4231-9681-cc472dca78c1","resolution":{"observed_at":"2026-08-15T17:22:19.064966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.041350Z","title":"Distributed vlms: Efficient vision-language processing through cloud- edge collaboration","venue":null,"work_id":"d0efbe1b-2197-4ffc-8a93-66071aa1698b","year":null},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.025081Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:9b57ab755591b2de9f5397d5420b44e60d9338fbb86cb79d32ce10a7ad1a82f3","observation_id":"80c498af-44e4-42b1-971b-8707765b0b66","resolution":{"observed_at":"2026-08-15T17:22:19.047104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.006951Z","title":"Making large vision language mod- els to be good few-shot learners","venue":null,"work_id":"7a59f777-eaf8-407e-bd79-6e952c8d660e","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.034906Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:820bb050cdd4e0831b405240b917b422b167d9be2a50a093e2e50a01cd9dc44c","observation_id":"fd3c8bd4-950f-403b-889e-289cdfabb88f","resolution":{"observed_at":"2026-08-15T17:22:19.012503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.988701Z","title":"Rea- songrounder: Lvlm-guided hierarchical feature splatting for open-vocabulary 3d visual grounding and reasoning","venue":null,"work_id":"ffdc7d0f-e9ba-4725-8ead-7587d16c3ef7","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.039571Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:7ef5b9b6e4c37de7df3422c7ecdb895dda148d33b7afb6f4f5fcd7a1ce78744f","observation_id":"d644719d-cd37-4d00-aba8-4b1e9955ee1a","resolution":{"observed_at":"2026-08-15T17:22:18.994951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.971982Z","title":"Bluelm-v-3b: Algorithm and system co-design for multimodal large language models on mobile devices","venue":null,"work_id":"7bed20ff-d2be-4a21-8ff2-f3dd2a3208d8","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.044395Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:f9687c6b80336ebae2d129b5cff8461ced6c91ca9a0ab78f4d881e52d70c112d","observation_id":"2f64f138-6c39-449b-b66e-44bc50ae072d","resolution":{"observed_at":"2026-08-15T17:22:18.977453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.954744Z","title":"Can lvlms obtain a driver’s license? a benchmark towards reliable agi for autonomous driving","venue":null,"work_id":"f4370b7d-58fb-4a69-bfda-45dcdc01532f","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.049039Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:8484332155a69393b061486c174cb282e89d75d5afedabf5851039a3c2d763be","observation_id":"37bef618-50b9-479b-8a12-e2404c0a5aa8","resolution":{"observed_at":"2026-08-15T17:22:18.960440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.935488Z","title":"Maximizing subset accuracy with recur- rent neural networks in multi-label classification.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"d642706e-054a-415f-a1eb-bd2af8c55abe","year":2017},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.053934Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:ad8e5bd48c364d81794b3053aab95049d4a7132f5f452e1d6d087f36d7185b9f","observation_id":"3141881a-a648-4d3a-afa5-55c3b3f17c3d","resolution":{"observed_at":"2026-08-15T17:22:18.941631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.058604Z","title":"Metaspatial: Reinforcing 3d spa- tial reasoning in vlms for the metaverse.arXiv preprint arXiv:2503.18470, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.058604Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:732f27089853eee01d25c9d848eb53a0391a24f38fcb8c356aad970a5e4e2201","observation_id":"34700582-0dda-4b2a-8f4f-d3ef76911278","resolution":{"observed_at":"2026-08-15T17:22:18.058604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.917745Z","title":"Eve: Efficient multimodal vision lan- 9 guage models with elastic visual experts","venue":null,"work_id":"c7466a39-954f-43d9-a22c-1ff7c23a5a89","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.063129Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:b90121ff9935e11551d5604965444fa965743568e32d95f6e2b96a3aacd8a4a3","observation_id":"d53ea1eb-88f2-4c7d-849f-c6381f5a634e","resolution":{"observed_at":"2026-08-15T17:22:18.923490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.067735Z","title":"Lmdrive: Closed-loop end-to-end driving with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.067735Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:f21c14057503c898eaa17081bd7d53016ca94991d215f41e64cf9f4cb5037856","observation_id":"65522919-f769-4d9a-8d6b-a1a021f1218d","resolution":{"observed_at":"2026-08-15T17:22:18.067735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-08-14T23:38:19.973422Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-15T17:22:18.072577Z","title":"Vlm-r1: A stable and generaliz- able r1-style large vision-language model.arXiv preprint arXiv:2504.07615, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.072577Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:7dda84a1437b22a1a52dccfefad3b3495531fb6890ffc6e2a4ae25618e4dc124","observation_id":"9ceaaea3-7e08-4b2e-b3fa-18837dc6f9af","resolution":{"observed_at":"2026-08-15T17:22:18.072577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.886951Z","title":"Kitchen scene context based gesture recognition: A contest in icpr2012","venue":null,"work_id":"cedad46d-6eab-4a93-9387-044414a7c9a2","year":2012},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.078180Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:7bdb00df4796ce6d447aeaa23d942a29062b8fa6c2a675296e4eab02b0b6547e","observation_id":"6d164c00-ef2b-49f2-9308-149a97e9310b","resolution":{"observed_at":"2026-08-15T17:22:18.892577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.868922Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":"239f56ee-f6cd-4d12-baac-22f724b2c8ac","year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.084063Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:47886f4a9e113c00be7f8d8caf60582293bda431e87e3c404c1500e77bab32db","observation_id":"9689afbf-3578-44b3-be56-72e479916945","resolution":{"observed_at":"2026-08-15T17:22:18.874683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16775","last_updated":"2024-10-22T07:45:18Z","snapshot_observed_at":"2026-08-16T13:07:05.865485Z","submitted_at":"2024-10-22T07:45:18Z","title":"Context-Aware LLM Translation System Using Conversation Summarization and Dialogue History","version":1},"cited_work":{"arxiv_id":"2410.16775","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.16775","snapshot_observed_at":"2026-08-15T17:22:18.438321Z","title":"Context-Aware LLM Translation System Using Conversation Summarization and Dialogue History","venue":"cs.CL","work_id":"1d148608-0139-42a1-9897-ac291f0bc400","year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.088654Z"},"links":{"cited_paper":"/paper/2410.16775","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:6d21ec7c6384e7a773438b8a762c91370b869a5e55446c74c0904caa7e67d9a0","observation_id":"b18921f2-e2ff-4a59-8517-c0812136c466","resolution":{"observed_at":"2026-08-15T17:22:18.445877Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-08-13T08:07:31.942031Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12289","snapshot_observed_at":"2026-08-15T17:22:18.093930Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models.arXiv preprint arXiv:2402.12289, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.093930Z"},"links":{"cited_paper":"/paper/2402.12289","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:8e367ad125991e166d0c7b905ec7668b80612f447032018f9070073e07889e1d","observation_id":"2ff485ac-5b34-4d26-9874-0daf90c654c9","resolution":{"observed_at":"2026-08-15T17:22:18.093930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.852294Z","title":"Fastvlm: Efficient vision encoding for vision language models","venue":null,"work_id":"bc72a64f-af41-4b3f-a8ac-e1ae81b41138","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.099423Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:b1b43a9b72e7eb78d80aaa3553808c3dedda5603940ee86f4c1804939f01989a","observation_id":"bbed818d-b084-4800-b0ad-de50f409fa26","resolution":{"observed_at":"2026-08-15T17:22:18.857762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20234","last_updated":"2024-09-06T02:41:35Z","snapshot_observed_at":"2026-08-16T13:47:40.526632Z","submitted_at":"2024-05-30T16:36:47Z","title":"Hidden in Plain Sight: Exploring Chat History Tampering in Interactive Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20234","snapshot_observed_at":"2026-08-15T17:22:18.104288Z","title":"Hidden in plain sight: Exploring chat history tampering in interactive language models.arXiv preprint arXiv:2405.20234, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.104288Z"},"links":{"cited_paper":"/paper/2405.20234","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:5d5bfe0cbd6dbe6f8e907e98c248b2fd1061bc3f4a2f9f9356dab4751eb147d7","observation_id":"46f4808a-217c-4299-9abe-e79f859bcc23","resolution":{"observed_at":"2026-08-15T17:22:18.104288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.109686Z","title":"Visual planning: Let’s think only with images.arXiv preprint arXiv:2505.11409, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.109686Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:8391b9353949b151d8ac8e27eb7b5165e5aa2552b3bab4d91ed46036a6b283fd","observation_id":"525592d4-84c8-447e-858e-bec7868c89b6","resolution":{"observed_at":"2026-08-15T17:22:18.109686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.836312Z","title":"Progress-aware video frame captioning","venue":null,"work_id":"554ec490-e1db-43a4-a38f-a26e84769822","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.115426Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:be6d0112f4cca2ab7f75659c9b4b8ad28e2834dd7f29bdc154e514f4a497e554","observation_id":"e21fdd00-e110-4cc3-87dd-5416e637b46c","resolution":{"observed_at":"2026-08-15T17:22:18.841724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-15T17:22:18.120275Z","title":"Minicpm-v: A gpt-4v level mllm on your phone.arXiv preprint arXiv:2408.01800, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.120275Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:d999ae49ad7a922e64888444ff51a83d767be140079a9052b43394a4a73c5ada","observation_id":"c90e0d99-6b2a-4aa2-846e-edf79b368cce","resolution":{"observed_at":"2026-08-15T17:22:18.120275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.819374Z","title":"Bdd100k: A diverse driving dataset for heterogeneous multitask learning","venue":null,"work_id":"0ac71927-f8dc-4d04-aa65-f274ee066272","year":2020},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.125647Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:edcd532117f71d9be6bcc117c9504b51cca61b08138d368858afbad96ae17ced","observation_id":"33a7941e-a51e-4114-87d5-a4f4e443063d","resolution":{"observed_at":"2026-08-15T17:22:18.824571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15436","last_updated":"2025-12-05T05:44:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-21T12:18:15Z","title":"Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15436","snapshot_observed_at":"2026-08-15T17:22:18.131316Z","title":"Chain-of-focus: Adaptive visual search and zooming for multimodal reasoning via rl.arXiv preprint arXiv:2505.15436, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.131316Z"},"links":{"cited_paper":"/paper/2505.15436","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:dec4c18f78dde0bc92340feba59a8a2247cc2155542b846ac259d92332597149","observation_id":"10a0adb6-a6e0-42a0-8a98-6bea137e8f8a","resolution":{"observed_at":"2026-08-15T17:22:18.131316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.801651Z","title":"Vavlm: Toward efficient edge-cloud video analytics with vision- language models.IEEE Transactions on Broadcasting, 2025","venue":null,"work_id":"e190b8ce-1abf-41ba-80c6-7ab4d5d1d71a","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.136879Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:0d60ce41439a7388251fedcc74dfabeb9136d9694f00eace21c7abeba6aafb30","observation_id":"549b3d98-faf5-4caa-966f-dd41559c060b","resolution":{"observed_at":"2026-08-15T17:22:18.806848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.784424Z","title":"A stitch in time saves nine: Small vlm is a precise guidance for accelerating large vlms","venue":null,"work_id":"be971baf-6c93-4bd0-8eab-fd0b5fbba0e2","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.141987Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:711cb4887bbe80203641ab243ddc4ee841298e0052945f2b13b88ebfbcea212d","observation_id":"56c2cf9d-cc8a-4607-b740-dddcf4ff7c6f","resolution":{"observed_at":"2026-08-15T17:22:18.789589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.767897Z","title":"Physvlm: Enabling visual language models to understand robotic phys- ical reachability","venue":null,"work_id":"788f8869-f960-47e1-8bbb-23b38238ab56","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.147348Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:06dc1acd6116a7e304e2d465364acba9121d500063aaaeb9616b986c0c4f6664","observation_id":"7639d549-8037-4369-9b6a-8773506d2b3b","resolution":{"observed_at":"2026-08-15T17:22:18.773059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.751506Z","title":"Deepeyes: In- centivizing ”thinking with images” via reinforcement learn- ing","venue":null,"work_id":"cc182fbf-d5d4-4ab0-8a74-84c037443573","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.152078Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:877be981f775b65f7ea48c70a434822f2d62e0a9ab0dd0c841286c9da7195816","observation_id":"8af9e7eb-3d95-44e9-94ce-a5b028047405","resolution":{"observed_at":"2026-08-15T17:22:18.756784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:18.735015Z","title":"Ground-v: Teaching vlms to ground complex in- structions in pixels","venue":null,"work_id":"e48923b0-a7b7-4fe1-ac47-e0c4402fcad8","year":null},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.156922Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:ae00d1bd2dd4daac67e98402c2891d8f3ae6b431843ed4679dc9bce3c0838766","observation_id":"0e60bdd7-49c7-4984-9de5-2542c0ded048","resolution":{"observed_at":"2026-08-15T17:22:18.740614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:22:19.024004Z","title":null,"venue":null,"work_id":"6e3eb22e-9bbc-47db-b169-d3897c1eb16c","year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":286,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:18.030237Z"},"links":{"citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:b25e5b5eb80c39157b91b8fcededf53f8345ff23850974a528b1764b32f41602","observation_id":"293eb654-ea1a-45ed-a779-944afe4b56d1","resolution":{"observed_at":"2026-08-15T17:22:19.029543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2508.12637."}