{"as_of":"2026-08-05T10:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:537dba8a2161ad3eee25f4300e4480d591e4efc4f561b15d2a5166ecec8e9cdd","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T06:26:22.635106Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06420/citation-record","integrity":"/paper/2607.06420/integrity","json":"/paper/2607.06420/citation-record.json","paper":"/paper/2607.06420"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.199843Z","title":null,"venue":null,"work_id":"14b75ed3-a715-4547-bf66-f7e3b3642cb2","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:3f70a024b7b36d49bca3a190c7d79f05f30e31732614da6ec5b97dafd427ec01","observation_id":"8fa20bac-0b71-426b-b896-1e8f5f92e73f","resolution":{"observed_at":"2026-07-08T06:34:42.200933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.169504Z","title":"Tallyqa: Answering complex counting questions","venue":null,"work_id":"bfee5365-9d55-4923-a6e6-fe307549fe21","year":2019},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:5eec093de9535f2acb2c8f80923d732107c2dce8c9c82e958a0597ad449a32a4","observation_id":"3c52c85b-1fcf-4ce0-b29f-85770cdd68bd","resolution":{"observed_at":"2026-07-08T06:34:42.171856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:0bcc98f682c32f7c2ba66445bc0dd1000b4979f1c8ab846adce466aa12e0e571","observation_id":"7093ef10-290c-4fcd-bd35-d21a6248befc","resolution":{"observed_at":"2026-07-08T06:34:41.880243Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:7b1d1fea0223552d7d1ada680e42fda83088386f0776203cfb3d1ac7e1e65cd8","observation_id":"fe0d20ed-a563-4002-8ddb-612ffeb13b12","resolution":{"observed_at":"2026-07-08T06:34:41.882983Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T09:34:48.459543Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":"19dbc933-eff7-47da-894e-0cb819f498b9","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:23c94e90ab2e901d1b2d59b7d87806a3de0bbcbfcfa19ebc5d00089d4e075041","observation_id":"573445af-a9a9-46a4-b35d-61bfcd7df46f","resolution":{"observed_at":"2026-07-08T06:34:42.174508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.188864Z","title":"Mvi-bench: A comprehensive benchmark for evaluating robustness to misleading visual inputs in lvlms, 2026","venue":null,"work_id":"c8ff0121-688e-4158-a889-bba39c3c1fbe","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:e766365e4e40c89b6e23d4d1b30e5ebc47888eca6b6dc6a7ade6f99e21f3ea2b","observation_id":"74f227b6-1edc-4763-bda5-00cd4c721aaa","resolution":{"observed_at":"2026-07-08T06:34:42.190137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T12:44:53.734066Z","title":"Spatialrgpt: Grounded spatial reasoning in vision-language models.Advances in Neural Information Processing Systems, 37:135062–135093","venue":null,"work_id":"2d59e7cb-d5c8-46e5-bd0b-7158b959b653","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:4274ed4cf54c2f5b75c773fc187258908cd939c9419417bc9fa1cf6dc80c53cf","observation_id":"e3eb160e-dfb0-466f-b1fb-6f49ae2a6598","resolution":{"observed_at":"2026-07-08T06:34:42.209679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.175131Z","title":"Molmo and pixmo: Open weights and open data for state-of-the-art vision-language models","venue":null,"work_id":"82bab183-1c79-4673-9bd9-d609312d9127","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:f6bda61d63be8aa447c643b029a345a6b75015d1af7fbaeebfb5bdca405d7bac","observation_id":"c3ac939f-8031-459f-b345-ca5e6fbc6a0a","resolution":{"observed_at":"2026-07-08T06:34:42.176761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.187049Z","title":"Deep learning in crowd counting: A survey.CAAI Trans","venue":null,"work_id":"1da99f40-5d94-40d6-8247-4b6250a121c2","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:71cc8d418c0cbb52a21796ea09c3eb888cd0eb47d2ad6952d276bdd9884e4573","observation_id":"c7194e0d-b2f2-411a-ab6a-9a793175dc8f","resolution":{"observed_at":"2026-07-08T06:34:42.188325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.215676Z","title":"Lvis: A dataset for large vocabulary instance segmentation, 2019","venue":null,"work_id":"588051d9-6dbf-484c-8d0b-c87da4883c13","year":2019},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:ec1ddfc06d34c6c2de681e7cab336551a635b5c1cb1192e9c0dabe293266daf0","observation_id":"8a35f6cb-9d5c-4445-ad9b-bdd6df7302cf","resolution":{"observed_at":"2026-07-08T06:34:42.216854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.138177Z","title":"Drone-based object counting by spatially regularized regional proposal network","venue":null,"work_id":"abbb1974-f9d5-4a5e-91e4-8271e67ae540","year":2017},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:60b89efe053007d192f359665fb6e4e85f53821eb5c6ce9484cb3ac686305391","observation_id":"78b101d5-c2b2-4347-a72c-e9e2a32579b1","resolution":{"observed_at":"2026-07-08T06:34:42.139408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.09668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:41.894993Z","title":"Step3-vl-10b technical report","venue":null,"work_id":"b7059382-9467-45e4-b9f6-a83382eaeba4","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:b11b7f1ea7a1d0bf7b02713ab5ba96a253656cef0428726cfa075fc7148a67ea","observation_id":"1c872b51-70d2-485c-b0c6-d467533888ee","resolution":{"observed_at":"2026-07-08T06:34:41.896789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.152384Z","title":"Kevin Zhou, and Jie Chen","venue":null,"work_id":"2f3315dc-2ac9-47b7-a57b-be4c48804aeb","year":2020},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:8038c70032cd42e6c3a32628ef7a9cbfa20becf5f7c45aeff1933006e76fbe55","observation_id":"0b09cf54-657a-400d-a718-30bde30571e0","resolution":{"observed_at":"2026-07-08T06:34:42.153440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.159514Z","title":"Composition loss for counting, density map estimation and localization in dense crowds","venue":null,"work_id":"935be35a-7391-4ac9-9e1c-5dc429e5ad27","year":2018},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:101044a143e19e706215fd49028ebae696192ca1eae82431b558e8963c6af182","observation_id":"466ae958-844f-43cb-a6c5-314154b8f41c","resolution":{"observed_at":"2026-07-08T06:34:42.160732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.210379Z","title":"Vlind-bench: Measuring language priors in large vision-language models, 2025","venue":null,"work_id":"7ebfe312-9e02-4588-a67e-14c5dad16167","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:e1895e6da8cbfeb0a74bb289e6e000511e6920d7dd5fad4be1b71a3a24587b58","observation_id":"6837b810-8840-41d2-a92e-409616fb465e","resolution":{"observed_at":"2026-07-08T06:34:42.211591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.149038Z","title":"T-rex2: Towards generic object detection via text-visual prompt synergy","venue":null,"work_id":"0f6a3b4b-f9a7-4614-97c6-f3719ddde0c6","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:736dfd2930b14b4b0ee2674a71bfff0ae2fe6d874bcd8a62c3fe5f9d94502122","observation_id":"f6f310ef-3507-4f03-8290-93a4db717507","resolution":{"observed_at":"2026-07-08T06:34:42.150162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.150709Z","title":"Learning To Count Objects in Images","venue":null,"work_id":"20d21631-81d5-4d7d-9e4d-b7863fd7257b","year":2010},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:be53a690f9cd4889220257056ae0fccf01757cf5be024c09b1d880b4d63d63a5","observation_id":"7cbc1146-1468-4b2d-a8ef-b10c237ba46a","resolution":{"observed_at":"2026-07-08T06:34:42.151787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.139947Z","title":"Count anything at any granularity, 2026","venue":null,"work_id":"82ff87b7-a4dd-4476-81c1-eafbe23b72a5","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:b45c62ac75442f2cdd99eb34dbb983e5afd12923ff03ea69afe12593c5be8c13","observation_id":"e7eba03a-ac7d-45ee-96b0-e56fa0a6c174","resolution":{"observed_at":"2026-07-08T06:34:42.141084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:16:04.690179Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916","venue":null,"work_id":"115823a2-8918-4227-8872-3d0a36ff07a9","year":2023},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:cdedb5e746609622716a41cfcddf5da5a8ea974aaafc325893fbc7e3d649b392","observation_id":"dae70fd7-dc3e-46aa-821b-fa3fed50292d","resolution":{"observed_at":"2026-07-08T06:34:42.186451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:26:52.337971Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"98d774c8-2295-4dc2-82fb-624467a40d12","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:b03371797d83ea920b6ec5eb3aa7468a758a3659b5289ff9c068ace9f5e8083f","observation_id":"233bae5b-c348-4feb-a794-fb7cddbb3933","resolution":{"observed_at":"2026-07-08T06:34:42.199299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.223934Z","title":"Moment-video: Diagnosing temporal fidelity of video mllms on momentary visual events, 2026","venue":null,"work_id":"8f6d7158-eced-4384-bc41-3c476c2e584b","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:fbf8ce214315ad99a997727aa0fe2131256d559f29e7728bdcdc258fa7180e44","observation_id":"caf89b32-4c5d-4d2d-9719-d061ea016406","resolution":{"observed_at":"2026-07-08T06:34:42.225095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23050","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:41.892057Z","title":"Understanding language prior of lvlms by contrasting chain-of-embedding","venue":null,"work_id":"df75cf90-0712-4c74-acfb-61dd921ba1b9","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:03c0c4ab6152e692664d014dda943f909e7c627b7224a98b1db76607cf0f0612","observation_id":"36507d60-7705-4c6e-9919-134ea512fb61","resolution":{"observed_at":"2026-07-08T06:34:41.893614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.227384Z","title":"Av-reasoner: Improving and benchmarking clue-grounded audio-visual counting for mllms, 2025","venue":null,"work_id":"0bf7491c-5c88-488c-85f6-f7420f3ccc44","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:3725a0b99e064b10f01cb6e6248518fc96255698b86141d5990e61eb44563d9f","observation_id":"d467d462-447c-413c-9559-182cf21d9a00","resolution":{"observed_at":"2026-07-08T06:34:42.228640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.161325Z","title":"Deep learning for site safety: Real-time detection of personal protective equipment.Automation in construction, 112:103085, 2020","venue":null,"work_id":"200f4102-9f3f-42d3-a6cf-70fd5db3067f","year":2020},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:172dcf82271ea00931b3f2f1cbca95e48c18caa76161c4e26ed7d6dee3afefc4","observation_id":"18af80ff-2a2e-4746-a0e7-675cec26e711","resolution":{"observed_at":"2026-07-08T06:34:42.162580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.240463Z","title":"Can current ai models count what we mean, not what they see? a benchmark and systematic evaluation, 2025","venue":null,"work_id":"d7819877-03e0-4141-b71f-79841085ea8b","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:f0a89cd9ae953b60c78b38ecc6ac1207095f37f207755c4b33a958473f897de0","observation_id":"c2da1919-3cb4-4059-a686-d3284442eb59","resolution":{"observed_at":"2026-07-08T06:34:42.242504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.190704Z","title":"Few-shot object counting and detection","venue":null,"work_id":"def98ae7-dea2-4050-ac58-9a72dc59ebed","year":2022},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:6d33b71f5f69b540d39ab0b34bd8f3172687db8b56b88156852f8ad6bfb0a4c0","observation_id":"66862931-59dc-4f3f-af9a-1508713330d6","resolution":{"observed_at":"2026-07-08T06:34:42.191929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.181012Z","title":"Small object detection: A comprehensive survey on challenges, techniques and real-world applications.Intelligent Systems with Applications, 27:200561, 2025","venue":null,"work_id":"254b412c-7ad0-4c18-aa8e-f60559b573ac","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:ee72de91d7b14f9aa57c5e0839717a8914b523978e2793c6112642096a21f615","observation_id":"f26bcc51-7380-4b48-95f5-768c486d6d9c","resolution":{"observed_at":"2026-07-08T06:34:42.182436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.183044Z","title":"Enhancing object detection in smart video surveillance: A survey of occlusion-handling approaches.Electronics, 13(3):541, 2024","venue":null,"work_id":"cbfe14e9-1c32-4243-8be5-524883be8bf4","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:e6af475f35c4953cb754391b3a819684c4b8e3dc1d90b73bb5944135ada9d602","observation_id":"9a40c73c-47cb-45a1-9730-f9894d3eb39a","resolution":{"observed_at":"2026-07-08T06:34:42.184386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.177347Z","title":"Teaching clip to count to ten","venue":null,"work_id":"562c191c-eb69-4281-a746-3ef6c78b48eb","year":2023},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:5f5267706e9fb8115e843b4bfbebd38ba9f509757b01dd8e1fd5959dbcc14859","observation_id":"1418cada-3320-4054-859b-49fb5c539ba2","resolution":{"observed_at":"2026-07-08T06:34:42.178442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.220646Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"429f97ab-9d82-4f69-86fa-eeb917a577cd","year":2021},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:e7a9e52efb1f0481aeb97252b979ff82d49cffda0f50b86065b74bcb83917d76","observation_id":"c87cfc39-513b-4266-a1af-181aecdf5bbb","resolution":{"observed_at":"2026-07-08T06:34:42.221935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.201466Z","title":"Learning To Count Everything","venue":null,"work_id":"5158d7eb-64eb-407d-80b1-0fece2de8d45","year":2021},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:7ebfad89de5d83a3ba83815d4dd414941b63ef7ac4d2e7539f4c2ae2d6f13963","observation_id":"7b4ea410-ee1a-496f-9116-07761c27aa32","resolution":{"observed_at":"2026-07-08T06:34:42.202485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.229211Z","title":"Unicbench: Unified counting benchmark for mllm, 2026","venue":null,"work_id":"b7290470-5548-42e5-aca5-0f70582a554a","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:841893e09dca1b25c3f252d1933b8be5f3092629bbfb06f399fc9ec93ee23b2e","observation_id":"cae60345-00c3-4350-99db-b3d579ec1270","resolution":{"observed_at":"2026-07-08T06:34:42.230494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.206637Z","title":"Objects365: A large-scale, high-quality dataset for object detection","venue":null,"work_id":"a710cbdd-874d-44f4-aa96-56dcd55cf25f","year":2019},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:e3bea6a9a2e109e7fe9c142972e8e61db381598f2d2ad37865c766bc0a1518ea","observation_id":"a7aefbf4-4814-410b-adf7-2fcee5b476f2","resolution":{"observed_at":"2026-07-08T06:34:42.207815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.155835Z","title":"Sindagi, Rajeev Yasarla, and Vishal M","venue":null,"work_id":"fb1df39e-3ea1-40f2-85a8-5079e339c4d7","year":2022},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:31e528af170fd9ec61ef2fed55a25a3f9f2fd4ce9fe3ca942ddb26788d85b6c7","observation_id":"01fabb1f-1e45-4555-ab99-15f15bdb27fb","resolution":{"observed_at":"2026-07-08T06:34:42.156951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06585","last_updated":"2025-09-09T04:46:37Z","snapshot_observed_at":"2026-07-06T22:10:11.873662Z","submitted_at":"2025-08-08T04:23:04Z","title":"CountQA: How Well Do MLLMs Count in the Wild?","version":2},"cited_work":{"arxiv_id":"2508.06585","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.06585","snapshot_observed_at":"2026-07-08T06:34:41.866253Z","title":"Countqa: How well do mllms count in the wild?","venue":"cs.AI","work_id":"c789d1d0-2831-4ce9-a49a-d7e1676dcb24","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2508.06585","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:1903fbe61d6743fad2b5e8f80901e196bc457e13cdc1d8b3538d50d8a1af5f67","observation_id":"f912a87b-ae2b-4581-8309-6827469cea24","resolution":{"observed_at":"2026-07-08T06:34:41.868005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.234881Z","title":"Gemma 3 technical report","venue":null,"work_id":"eb0c53a4-5349-4070-b2c4-fd5ad375d65e","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:2fb8d4aed29165c416a32b3874bf312580504aad6ac0882f96f4bca8cc622801","observation_id":"8bf2499a-ad47-4b40-973d-d456fee6fd22","resolution":{"observed_at":"2026-07-08T06:34:42.236287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.143616Z","title":"Internvl3.5: Advancing open-source multimodal models in versatility, reasoning, and efficiency, 2025","venue":null,"work_id":"b761659e-ef8c-4434-8717-86e24f1bda13","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:b031526bc091f4924cb8a0c0fa40a801bab4092588c3060494bb5f0321bf5e6d","observation_id":"6dfe38b7-84a0-4a0f-829a-0099d51d9fe8","resolution":{"observed_at":"2026-07-08T06:34:42.145101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.145700Z","title":"Kimi k2.5: Visual agentic intelligence, 2026","venue":null,"work_id":"edccf11e-27b0-45e6-a07c-9b2d3894002d","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:0ab7baba74a90d47650d755612c9438af7ddf06b397adb6fd23c3f15fda2fbfb","observation_id":"f61a077e-ddf0-4d6b-9848-1975cefcd23e","resolution":{"observed_at":"2026-07-08T06:34:42.146869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":"2504.07491","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-07-08T06:34:41.884360Z","title":"Kimi-VL Technical Report","venue":"cs.CV","work_id":"c876520f-8a20-44f3-b92a-bf7d35bd430f","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:9630823496788e9938123087e13d6e5a4dd6bf4fb4d76bbec53052197bbbd5f1","observation_id":"458b0402-adb1-444c-a96d-81b82ccd0ae2","resolution":{"observed_at":"2026-07-08T06:34:41.885798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01949","last_updated":"2025-07-02T17:57:28Z","snapshot_observed_at":"2026-07-06T21:51:14.737439Z","submitted_at":"2025-07-02T17:57:28Z","title":"Kwai Keye-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2507.01949","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01949","snapshot_observed_at":"2026-07-08T06:34:41.887069Z","title":"Kwai keye-vl technical report","venue":"cs.CV","work_id":"fed210bf-996d-4575-8d81-8a68e02c9d03","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2507.01949","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:f964703b20218772fd36e2214d5149e23845caa9689096a05f6add19051daf6c","observation_id":"8b83f04a-2d77-4d8d-af95-6ebbfa54e923","resolution":{"observed_at":"2026-07-08T06:34:41.888370Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:37:51.331647Z","title":"Qwen3.5: Accelerating productivity with native multimodal agents, February 2026","venue":null,"work_id":"4f614eb5-49d5-415f-b8b9-070dc8b927a1","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:39dc0037b531426dabeb60a03bae8da07cfc4a56b8060226488e728ccc33e9b5","observation_id":"75541853-4255-4bf7-95d7-405b8788a66c","resolution":{"observed_at":"2026-07-08T06:34:42.142838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.147404Z","title":"Ec-bench: Enumeration and counting benchmark for ultra-long videos, 2026","venue":null,"work_id":"a9a31ead-ac41-4e80-84dd-e44b0baadab2","year":2026},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:30c5677c77dd4d081f1c8eb01184348d1723a3c2d94ca069d57295ea127ae133","observation_id":"f31a907b-c8fa-46a3-aa29-254af5aebbf9","resolution":{"observed_at":"2026-07-08T06:34:42.148528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:4123dea4a999a55c6bcba21a2d8b4737c8a85195eed3cad309b5f7ff49f80927","observation_id":"075437c2-f84b-473d-819e-a0484ae9d51a","resolution":{"observed_at":"2026-07-08T06:34:41.874709Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.157486Z","title":"Nwpu-crowd: A large-scale benchmark for crowd counting and localization.IEEE transactions on pattern analysis and machine intelligence, 43(6):2141–2149, 2020","venue":null,"work_id":"125f0b0a-8b0d-4389-ad82-77bcce2046bc","year":2020},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:149c1c6fbc0a31572a58fabee1080080c256460bc98bc8764a09110f7db8a8a8","observation_id":"dc8ae552-ea18-44d1-8f44-4fabd8993d39","resolution":{"observed_at":"2026-07-08T06:34:42.158893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.154001Z","title":"A review of further directions for artificial intelligence, machine learning, and deep learning in smart logistics.Sustainability, 12(9):3760, 2020","venue":null,"work_id":"fa78f21d-5937-4e7a-ad38-2d2fe0abac9b","year":2020},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:47a04bc411d3713b1bee7e09f07d33f814918d05e539a125857dd42242a86578","observation_id":"8425ba86-f031-4470-8501-9dcc4ea379d4","resolution":{"observed_at":"2026-07-08T06:34:42.155278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12359","last_updated":"2025-02-17T22:48:34Z","snapshot_observed_at":"2026-07-06T20:38:15.649336Z","submitted_at":"2025-02-17T22:48:34Z","title":"LanP: Rethinking the Impact of Language Priors in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2502.12359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.12359","snapshot_observed_at":"2026-07-08T06:34:41.889550Z","title":"LanP: Rethinking the Impact of Language Priors in Large Vision-Language Models","venue":"cs.CV","work_id":"282e0df7-f88b-4a03-9580-bbff6e5a1892","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2502.12359","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:70c2931df0ff8496fe2a510b634fa632ab1ae62454482a92ffd858dbcd6bafc7","observation_id":"267946e7-2244-4386-af0e-61c9cdf05333","resolution":{"observed_at":"2026-07-08T06:34:41.890924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.164800Z","title":"Towards visual grounding: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025","venue":null,"work_id":"71c1c10f-1556-4de3-8ae8-14dbf3721be8","year":2025},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:9e97d4578ee81e4a966872a0d2da12a6014186308f18aa9630a903b024708fab","observation_id":"8fd680ac-2c19-40d2-8fd0-bad23a8f4131","resolution":{"observed_at":"2026-07-08T06:34:42.165990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.163097Z","title":"Learning to separate: Detecting heavily-occluded objects in urban scenes","venue":null,"work_id":"ad25ff70-eb6f-4d14-8c02-d3ec7bb97f3c","year":2020},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:c346986c3f73b2a0fa7acd562c32d874e283e22a8fcc67050bcea517625c50f2","observation_id":"29b1bf95-3b77-4317-8d77-26e1b167cfd1","resolution":{"observed_at":"2026-07-08T06:34:42.164259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.213953Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"9f082edc-5029-43c9-9cbb-01476804d481","year":2023},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:3a258e0facee2d88a095881cc58f010cad0d65c19c24302f8fe409fe7e9c526c","observation_id":"a4e7ff36-f46b-416f-83f0-af35208bbcd0","resolution":{"observed_at":"2026-07-08T06:34:42.215145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05766","last_updated":"2018-02-15T21:16:59Z","snapshot_observed_at":"2026-07-06T06:23:45.215820Z","submitted_at":"2018-02-15T21:16:59Z","title":"Learning to Count Objects in Natural Images for Visual Question Answering","version":1},"cited_work":{"arxiv_id":"1802.05766","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.05766","snapshot_observed_at":"2026-07-10T09:37:00.805098Z","title":"Learning to Count Objects in Natural Images for Visual Question Answering","venue":"cs.CV","work_id":"518a32d3-4b87-4774-ae3e-e5763f7a62ec","year":2018},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/1802.05766","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:537790886673d6c0e1ae85bbf51cd2ebcd7af868f439e6252ae89e92f7bb168a","observation_id":"e15d527c-0d53-40ef-b40a-425b65b4e0d6","resolution":{"observed_at":"2026-07-08T06:34:41.877542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13257","last_updated":"2025-02-05T08:44:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-23T17:59:51Z","title":"MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?","version":3},"cited_work":{"arxiv_id":"2408.13257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.13257","snapshot_observed_at":"2026-07-08T06:34:41.869562Z","title":"MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?","venue":"cs.CV","work_id":"140d79fb-a3d2-4af2-a436-9d997c171f61","year":2024},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"cited_paper":"/paper/2408.13257","citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:6301d8e844dd5e1e76dfaafb3327a0e874f5788a6b1417db7356b18f0243eeb7","observation_id":"6e681a5e-ef46-4fb5-9fc7-4830a6746dcd","resolution":{"observed_at":"2026-07-08T06:34:41.871618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.236891Z","title":"yellow flower","venue":null,"work_id":"8f06f724-25db-42b2-943e-cf1251f1268f","year":2016},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:9816db6a968961cfc9b801120cebb2989758c1a3d44d75803134d657128170ef","observation_id":"60afddaa-394c-4ac4-bcdf-a43422e90922","resolution":{"observed_at":"2026-07-08T06:34:42.238218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.238778Z","title":null,"venue":null,"work_id":"8d160c95-be63-410b-8140-b94a1028344f","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:f6d4d3c4edb64cc74a4f2dca5308048fc98a4b90a310ac4affef89af84e41d49","observation_id":"a526615c-dbd6-483b-9e27-bc2296c2ef58","resolution":{"observed_at":"2026-07-08T06:34:42.239956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.232897Z","title":"chair” not “chairs","venue":null,"work_id":"161c3e4f-179c-416f-8708-abee73bf53ec","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:5752f92096f96bafd49432f8f60282fb80adfa3c550a28b4127ffa01a23b5de0","observation_id":"04b8284d-1b56-40d0-aa3b-36b88f433aa8","resolution":{"observed_at":"2026-07-08T06:34:42.234263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.218981Z","title":"yellow flower","venue":null,"work_id":"f3063ba2-1848-4a47-9054-fd257aafafbb","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:65e00b39b22604fb806729095541dcd755a2f52f589e7814e8d6280a70c2c557","observation_id":"c9290edc-9415-4536-ab81-b322323aebd2","resolution":{"observed_at":"2026-07-08T06:34:42.220068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.194393Z","title":"How many more X than Y?","venue":null,"work_id":"6d503920-dd58-4426-b569-b19655c3a99d","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:b2ae7368568b807d7c2bbaaee64586eecaff7e2f23c1b2def694c5765cf744f6","observation_id":"a85a7d0e-428e-4196-9e5d-895b3408bf3e","resolution":{"observed_at":"2026-07-08T06:34:42.195671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.192491Z","title":null,"venue":null,"work_id":"b2bde0eb-69e4-4f58-99b8-105c3395695a","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:557eed40b7fd8d59bac99c542cca95daf394aaa49d0ac243c9db917701a1d7c1","observation_id":"6bfa925e-67df-489f-80fa-3d1abbffbeb7","resolution":{"observed_at":"2026-07-08T06:34:42.193811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.217398Z","title":null,"venue":null,"work_id":"06524ff8-7696-4ddf-96f2-6d1a14e1784e","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:2dee97def03dc7f6b47d4d55c768383e8d23a9b3345b3aa0a9b519124bab1ed2","observation_id":"ae872968-47a7-41a5-b06d-c662d7d1ea0e","resolution":{"observed_at":"2026-07-08T06:34:42.218479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.222457Z","title":"How many red cars?","venue":null,"work_id":"82a871ad-cb6e-403e-b29f-bb0c910d64d6","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:3cf5f8e3dc42692cdd73812885c416ddcff51a2e60e39425cd5d3d4cb8f91924","observation_id":"0cafec5c-5e18-4c91-b8ac-b0bf6a23c58f","resolution":{"observed_at":"2026-07-08T06:34:42.223448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.225653Z","title":"Count must be correct for this image","venue":null,"work_id":"21eb9d15-7e48-4c4e-991a-186b9b3c797d","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:1be6cc35f3a389625a1977846d998e41ac459a3abefa3fadfc6ddf6bf49d2ccf","observation_id":"4dec28e6-9815-4681-a9fc-0c7b7742078f","resolution":{"observed_at":"2026-07-08T06:34:42.226827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.178985Z","title":"How many more red cars than blue cars?","venue":null,"work_id":"cfca0474-d908-48c7-8277-9bf104956aac","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:895595174d8ae38028d65dc1046622fb83dedca3ad26e6a27ef99f7d3f0aa10e","observation_id":"daefa469-b1b3-4732-b57f-3aace3ca7558","resolution":{"observed_at":"2026-07-08T06:34:42.180436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.231029Z","title":"How many objects are both red and large?","venue":null,"work_id":"f94a24ba-d223-460f-af32-2387c7d03960","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:dfbf8d5020adecfc120d1232fe80d3853ac2d4a5fa209a0ac9813d0d124c15a8","observation_id":"6ede9905-df85-4177-91d8-6cde54ad26cb","resolution":{"observed_at":"2026-07-08T06:34:42.232279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.212125Z","title":"No external knowledge","venue":null,"work_id":"1f253c39-eb99-4f67-bf04-ddaa4a874152","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:df31fb4b3585d6f3389e4bd2effa0dbab1b79ece49e34da4b9368a446e6a4c9e","observation_id":"e2df6c94-52dc-450b-8d38-70609acd745a","resolution":{"observed_at":"2026-07-08T06:34:42.213386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.196221Z","title":null,"venue":null,"work_id":"4f9b62f2-a5dd-4f0e-8cd9-a141dc5a6d55","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:b05e8b611a2e4699e45c7cb7b155bd39629b013c780162f5b3d1bcea8f576104","observation_id":"f732a756-1c42-4156-aa9c-0d0f49b0056b","resolution":{"observed_at":"2026-07-08T06:34:42.197537Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.202983Z","title":null,"venue":null,"work_id":"05d87a22-aea7-45b3-8999-95155a045290","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:a33999e29b363a2c56caced7ca0314bc2bc03f268b7d993ac0d5ab272d8cd414","observation_id":"b65e5e84-50a7-4112-a5b1-550b863bdb3d","resolution":{"observed_at":"2026-07-08T06:34:42.204100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.204694Z","title":"How many objects satisfy condition A but not condition B, and are larger than the average size of category C?","venue":null,"work_id":"9391baf9-4d9a-4f14-8273-0930853b2fd1","year":null},"citing_paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-08T06:26:22.635106Z"},"links":{"citing_paper":"/paper/2607.06420"},"observation_digest":"sha256:aec6c301ad115e6f1dfd1a6eaa90650684e855f44a63701849ea05e263fd3414","observation_id":"bc4ce3ee-3fd9-4f6d-b503-48e094e146a5","resolution":{"observed_at":"2026-07-08T06:34:42.206055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06420","last_updated":"2026-07-07T15:48:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-10T23:18:26.069127Z","submitted_at":"2026-07-07T15:48:57Z","title":"HoloCount: A Holistic Visual Counting Benchmark for MLLMs"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":11,"verified_fuzzy":49},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2607.06420."}