{"as_of":"2026-08-11T10:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d3758c4ec3c1055889a2c5ee204dbba5ff9ca6e2fe39f521b619914c399223f","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T20:19:18.145721Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T13:53:13.255412Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T13:55:28.907050Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"cited_work":{"arxiv_id":"2602.23615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.23615","snapshot_observed_at":"2026-07-09T02:19:51.127350Z","title":"Annotation-free visual reasoning for high-resolution large multimodal models via rein- forcement learning.arXiv preprint arXiv:2602.23615","venue":null,"work_id":"fa53f23d-b500-442b-a7a0-393610ddb4fb","year":null},"citing_paper":{"arxiv_id":"2604.13565","last_updated":"2026-04-15T07:21:37Z","snapshot_observed_at":"2026-07-06T23:01:32.542040Z","submitted_at":"2026-04-15T07:21:37Z","title":"UHR-BAT: Budget-Aware Token Compression Vision-Language model for Ultra-High-Resolution Remote Sensing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T13:53:13.255412Z"},"links":{"cited_paper":"/paper/2602.23615","citing_paper":"/paper/2604.13565"},"observation_digest":"sha256:ff1e089adfa5145ac6bbf2284ceb303465eb6c886e88b74944b6d47db00a5356","observation_id":"b093fa26-d4ce-4b8a-97aa-daa1ec2ec902","resolution":{"observed_at":"2026-07-09T02:19:51.127350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.23615/citation-record","integrity":"/paper/2602.23615/integrity","json":"/paper/2602.23615/citation-record.json","paper":"/paper/2602.23615"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.048310Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.048310Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:2d4f3aa2b0eecd5cc7c55693e0a937a0dedc2e58e8872e42367f1fce0084eac9","observation_id":"275b3669-c68b-4811-9262-55cdb4878412","resolution":{"observed_at":"2026-08-02T20:19:13.048310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.111818Z","title":"In: Proceedings of the AAAI Conference on Artificial In- telligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.111818Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:7437bfea045e18ed3a94e770a857429ecf8e89e04d9f027ede7209d7189439c7","observation_id":"91979e10-953a-47f9-bb58-c286fd10c144","resolution":{"observed_at":"2026-08-02T20:19:13.111818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T20:19:13.167778Z","title":"5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.167778Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:da62ac8900409f61c4b804bfdcfe2c0bd3b591ae5a240e8ade6401e345feb333","observation_id":"4efb0695-f991-4e0e-bd61-732c6e3a1a29","resolution":{"observed_at":"2026-08-02T20:19:13.167778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06948","last_updated":"2026-05-30T09:01:09Z","snapshot_observed_at":"2026-08-04T22:56:01.963927Z","submitted_at":"2025-09-08T17:58:02Z","title":"Beyond Two-Stage Training: Cooperative SFT and RL for LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06948","snapshot_observed_at":"2026-08-02T20:19:13.273609Z","title":"arXiv preprint arXiv:2509.06948 (2025) 9","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.273609Z"},"links":{"cited_paper":"/paper/2509.06948","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:0a6d7340f5fd4fd44d7e7fd56dc2dbb921a2341cae211ac30695d1a6811c4936","observation_id":"9c0035fc-46c9-4bff-96ac-21a454e0d4dc","resolution":{"observed_at":"2026-08-02T20:19:13.273609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.386540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.386540Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:c0b3725b6c8f15cd8f8ebb1e2e557d1354619ce90fd7c81736ff40593513272a","observation_id":"97ffbdd2-4ce4-413c-b8c2-1c6e751fa778","resolution":{"observed_at":"2026-08-02T20:19:13.386540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02104","last_updated":"2024-12-03T02:54:31Z","snapshot_observed_at":"2026-08-11T02:03:00.199542Z","submitted_at":"2024-12-03T02:54:31Z","title":"Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02104","snapshot_observed_at":"2026-08-02T20:19:13.457923Z","title":"arXiv preprint arXiv:2412.02104 (2024) 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.457923Z"},"links":{"cited_paper":"/paper/2412.02104","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:53e3042b83b6a50b9c20e365d25d65176ab2e009cc77a66977af0947636b69d6","observation_id":"bb2e2c30-9dc5-43f9-a2d5-8101406fb5b0","resolution":{"observed_at":"2026-08-02T20:19:13.457923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.519729Z","title":"Advances in Neural Information Processing Systems37, 42566–42592 (2024) 2, 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.519729Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:65539b1ddc0d76d5200069848be83f47cbecd3738224b2f0e094637e15ec64ba","observation_id":"abc60261-8590-4fe8-a7e0-9ed001ac3d57","resolution":{"observed_at":"2026-08-02T20:19:13.519729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.573412Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.573412Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:fa8d1c9aa31f35d9f4c505173b5f57ba116e746bfa59af0343a09edfb1a4bb1b","observation_id":"69f9d66c-36c7-419d-9bbb-ac136c9c7967","resolution":{"observed_at":"2026-08-02T20:19:13.573412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.698688Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.698688Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:9f5825ff0e3ce47ca391de7e8ce5dc1e8727a56e0b06fc27e8074daaa9a17e0f","observation_id":"13db82c9-bf85-4f94-bc0d-2ae8bde85ccb","resolution":{"observed_at":"2026-08-02T20:19:13.698688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.819019Z","title":"Nature645(8081), 633–638 (2025) 1, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.819019Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:a03cb9111cc5dfa54d97c85de03696d4368a39a066e3d872be763e1cf1b4b00a","observation_id":"33aa45fa-ea8e-431f-90db-8d7ce1732832","resolution":{"observed_at":"2026-08-02T20:19:13.819019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12432","last_updated":"2025-05-18T14:08:03Z","snapshot_observed_at":"2026-08-07T23:21:52.042305Z","submitted_at":"2025-05-18T14:08:03Z","title":"Observe-R1: Unlocking Reasoning Abilities of MLLMs with Dynamic Progressive Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12432","snapshot_observed_at":"2026-08-02T20:19:13.888889Z","title":"arXiv preprint arXiv:2505.12432 (2025) 4 16 Authors Suppressed Due to Excessive Length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.888889Z"},"links":{"cited_paper":"/paper/2505.12432","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:b7696b2befd5e23bc4be313f185c5185c1101340d39d7d1923430060eacebb39","observation_id":"083c6a0b-ebfc-4fbd-8cd4-7ace85e552bb","resolution":{"observed_at":"2026-08-02T20:19:13.888889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:13.978780Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:13.978780Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:90bcdf50f32e452802cbf7dc6556f5e46e02ef69a351d355379c6d83cb0ad6b5","observation_id":"97acee85-ba2e-4c0c-bd92-a178adfb00ab","resolution":{"observed_at":"2026-08-02T20:19:13.978780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12895","last_updated":"2024-03-19T16:48:40Z","snapshot_observed_at":"2026-08-07T02:52:27.054968Z","submitted_at":"2024-03-19T16:48:40Z","title":"mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12895","snapshot_observed_at":"2026-08-02T20:19:14.038805Z","title":"CoRRabs/2403.12895(2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.038805Z"},"links":{"cited_paper":"/paper/2403.12895","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:3856e27eca895aeadd5d51c4c0ab1315c586c8833340f39a46e66177039d6214","observation_id":"dfca068a-ce1c-4348-87f7-f1a55734cadc","resolution":{"observed_at":"2026-08-02T20:19:14.038805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:14.109013Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.109013Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:e375b67788f42813a02a2f3e3a4fdddd51450f054fc135a6ee7f01d35ee3db0a","observation_id":"133447d1-ce7f-46b2-93f5-9fa881340a35","resolution":{"observed_at":"2026-08-02T20:19:14.109013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05920","last_updated":"2026-04-20T01:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-08T12:05:05Z","title":"High-Resolution Visual Reasoning via Multi-Turn Grounding-Based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05920","snapshot_observed_at":"2026-08-02T20:19:14.175809Z","title":"arXiv preprint arXiv:2507.05920 (2025) 2, 3, 4, 6, 7, 10, 11, 12, 13, 14","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.175809Z"},"links":{"cited_paper":"/paper/2507.05920","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:b9b2cf36f857f8432e28ad38bc4c088dd1fdf9bae9217ae614a7f1a2f396096b","observation_id":"75664f17-c17d-45fa-b449-11f4e9e77b56","resolution":{"observed_at":"2026-08-02T20:19:14.175809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-02T20:19:14.237828Z","title":"arXiv preprint arXiv:2410.21276 (2024) 1, 10, 11","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.237828Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:8e67b90a394199d95d50dc0890bbeee412200d5cd7119e99a39702fc4a2184af","observation_id":"f6dc410c-608e-4a26-ae4e-ae3f3b531be9","resolution":{"observed_at":"2026-08-02T20:19:14.237828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-02T20:19:14.285694Z","title":"arXiv preprint arXiv:2412.16720 (2024) 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.285694Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:ec7993b13c522576e1b9090317145b1ba4201bb1a89a2d7326180de7cd30a123","observation_id":"5a349c1f-8bf9-40d4-afb6-ef96a224426f","resolution":{"observed_at":"2026-08-02T20:19:14.285694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-02T20:19:14.414079Z","title":"arXiv preprint arXiv:2408.03326 (2024) 10, 11, 12","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.414079Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:ec04598be20edce00dcc70a9ca4c5d86a59a1e84e79d92e520929134a93b3efb","observation_id":"7b219928-df0d-4ee5-b6e3-25d108537fc6","resolution":{"observed_at":"2026-08-02T20:19:14.414079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:14.462843Z","title":"In: proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.462843Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:3a482099e7ddf4a7815ef2c6956511ea2df6ffa6d5cf4153123bf6993ad15e81","observation_id":"d0c609da-e448-422c-b6db-8d94a2441faa","resolution":{"observed_at":"2026-08-02T20:19:14.462843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19652","last_updated":"2026-04-27T16:28:37Z","snapshot_observed_at":"2026-08-10T21:29:25.180272Z","submitted_at":"2025-08-27T08:01:03Z","title":"Self-Rewarding Vision-Language Model via Reasoning Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19652","snapshot_observed_at":"2026-08-02T20:19:14.531269Z","title":"arXiv preprint arXiv:2508.19652 (2025) 4, 7","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.531269Z"},"links":{"cited_paper":"/paper/2508.19652","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:f0131706ef24f268ee8186230b8c76ff742a718f4fc31c8fcdfc4003aa379731","observation_id":"1b94b329-7fd3-4851-b138-f5d515deb13f","resolution":{"observed_at":"2026-08-02T20:19:14.531269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:14.591268Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.591268Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:4d9e0c135b47512e6da82a59de705c31984e2bdd5f9602e985e10cde080e54b0","observation_id":"422beb22-53ef-4611-96eb-9db5915e0bf6","resolution":{"observed_at":"2026-08-02T20:19:14.591268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:14.694209Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.694209Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:90238d02c60a3e31056c3d326ece7c76fb188ba6f929f5047627842d0538d9f6","observation_id":"ebcbe87e-571c-4426-ae49-a3f966f52203","resolution":{"observed_at":"2026-08-02T20:19:14.694209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:14.785165Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.785165Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:04e76a0af20fc2141213a89518538bb23c2684d7aaa39853bd0f7196f830d57b","observation_id":"11764147-a7f2-492c-b0fe-3cd9d206f8c8","resolution":{"observed_at":"2026-08-02T20:19:14.785165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04473","last_updated":"2024-03-15T06:51:30Z","snapshot_observed_at":"2026-08-09T20:40:14.205704Z","submitted_at":"2024-03-07T13:16:24Z","title":"TextMonkey: An OCR-Free Large Multimodal Model for Understanding Document","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04473","snapshot_observed_at":"2026-08-02T20:19:14.895125Z","title":"CoRRabs/2403.04473 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.895125Z"},"links":{"cited_paper":"/paper/2403.04473","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:1a14966999bcb4eadce2c7ab01abe87a96053e4d2a0582485fe61ed039235a34","observation_id":"a2564aa5-037b-4aff-a5fc-20746eea6fa1","resolution":{"observed_at":"2026-08-02T20:19:14.895125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01785","last_updated":"2025-03-03T18:16:32Z","snapshot_observed_at":"2026-08-05T03:13:54.147007Z","submitted_at":"2025-03-03T18:16:32Z","title":"Visual-RFT: Visual Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01785","snapshot_observed_at":"2026-08-02T20:19:14.979185Z","title":"arXiv preprint arXiv:2503.01785 (2025) 1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:14.979185Z"},"links":{"cited_paper":"/paper/2503.01785","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:52c898a57944179b89bb43521953ea32e65509b224ed9a51c20a20cbca3727cf","observation_id":"9e4ee4b3-3d4d-48a5-ad09-f02021c937b2","resolution":{"observed_at":"2026-08-02T20:19:14.979185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:15.077280Z","title":"In: The Thirteenth Inter- national Conference on Learning Representations (2025) 2, 4 Title Suppressed Due to Excessive Length 17","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.077280Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:dc0e04d23c7639435c42abca114c5f53dbcb690d646b47bbe6bb1d5909698dc2","observation_id":"81ccac28-6780-4ccc-bf9c-914ecbc5c514","resolution":{"observed_at":"2026-08-02T20:19:15.077280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12966","last_updated":"2024-03-21T16:26:44Z","snapshot_observed_at":"2026-08-10T12:01:03.840214Z","submitted_at":"2024-03-19T17:59:52Z","title":"Chain-of-Spot: Interactive Reasoning Improves Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12966","snapshot_observed_at":"2026-08-02T20:19:15.127415Z","title":"CoRRabs/2403.12966(2024) 2, 4, 5","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.127415Z"},"links":{"cited_paper":"/paper/2403.12966","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:af9062180d815b5366c0be15635b2edca44d7823f27e026cfdc4fa244d91c21e","observation_id":"684c86e5-0d91-499a-85b5-0a00f9524f72","resolution":{"observed_at":"2026-08-02T20:19:15.127415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09797","last_updated":"2024-04-15T13:54:35Z","snapshot_observed_at":"2026-08-09T19:46:42.652537Z","submitted_at":"2024-04-15T13:54:35Z","title":"TextCoT: Zoom In for Enhanced Multimodal Text-Rich Image Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09797","snapshot_observed_at":"2026-08-02T20:19:15.251753Z","title":"CoRRabs/2404.09797 (2024) 2, 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.251753Z"},"links":{"cited_paper":"/paper/2404.09797","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:04d7be158bcb375fe91adbdfea380add09f85e4cf2c61142c574638f6ce50bd0","observation_id":"9a53a9d3-7f3c-4e1b-9c85-eef5ff213a55","resolution":{"observed_at":"2026-08-02T20:19:15.251753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-09T01:06:58.674891Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-02T20:19:15.320680Z","title":"arXiv preprint arXiv:2503.07365 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.320680Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:81456c84138e7acff8ec69ecbb4d5d804145aa4544f0ecf65028c1001f1b6992","observation_id":"b4459221-2015-4fbd-84b5-4fd4fa2e20be","resolution":{"observed_at":"2026-08-02T20:19:15.320680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:15.380005Z","title":"IEEE Transactions on Intelligent Transporta- tion Systems26(3), 2851–2879 (2025) 6","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.380005Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:a27786593f315876c34cadbcc176c32769aa9a4d2ff0010f885f5529f4ce6fe1","observation_id":"1bb18f53-14e7-4282-8d02-654e57df0580","resolution":{"observed_at":"2026-08-02T20:19:15.380005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19702","last_updated":"2025-05-26T08:54:14Z","snapshot_observed_at":"2026-08-08T16:19:49.539801Z","submitted_at":"2025-05-26T08:54:14Z","title":"Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19702","snapshot_observed_at":"2026-08-02T20:19:15.437999Z","title":"arXiv preprint arXiv:2505.19702 (2025) 2, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.437999Z"},"links":{"cited_paper":"/paper/2505.19702","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:b0123c12d8e02c9014fcb0636a639dd2f82cff8d1398824aefc9be10ab15a3b6","observation_id":"0a366a8e-f5d7-4c05-a3cb-ee0d59a7e914","resolution":{"observed_at":"2026-08-02T20:19:15.437999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:15.496640Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.496640Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:b3907620cb375e89c184a7711ef65aad1bc9abe615e5e379a40787cecc4a024e","observation_id":"57104f53-df50-4023-b6e5-273abcc4c7e1","resolution":{"observed_at":"2026-08-02T20:19:15.496640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:15.540266Z","title":"com / index / introducing - o3 - and - o4 - mini/(2025) 11","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.540266Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:dc8e989c0d8930e171a5b3954c42c3bb2120ae64c441d3c47031cef740680c32","observation_id":"51541620-deeb-4096-8198-d3e7082789b6","resolution":{"observed_at":"2026-08-02T20:19:15.540266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-02T20:19:15.616914Z","title":"arXiv preprint arXiv:2503.07536 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.616914Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:8839a5d5682d5cf457062a81652acf54189c03db18cbf992ea936d6dafdb70ba","observation_id":"ba6059e0-13b4-4dfa-af91-b103e7177430","resolution":{"observed_at":"2026-08-02T20:19:15.616914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:15.699798Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.699798Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:a5481c3266b7a863382d074470c87378fd365f97bb1fb2a7025aa2e686c076d8","observation_id":"0b292c63-60a1-4069-83c9-ec4cccdec445","resolution":{"observed_at":"2026-08-02T20:19:15.699798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:15.760114Z","title":"Advances in Neural Information Processing Systems37, 8612–8642 (2024) 2, 4, 6, 12, 13","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.760114Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:d1d2b45f30912645b914557c078c02ee179de266a6937db4e1d57b472fe1ad41","observation_id":"f3731e62-beb4-4ec3-a6d7-b1d053f52556","resolution":{"observed_at":"2026-08-02T20:19:15.760114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T20:19:15.820927Z","title":"arXiv preprint arXiv:2402.03300 (2024) 5, 8, 10, 11, 12, 13, 14","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.820927Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:cfc87c980e96e40aaef0aaeae28c7758dfd2102527a3ab9fbb6fd120f7c4a829","observation_id":"ad32fce8-8c68-4be6-9f46-a407f2643bfe","resolution":{"observed_at":"2026-08-02T20:19:15.820927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-08-08T20:11:45.308315Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-02T20:19:15.914946Z","title":"arXiv preprint arXiv:2504.07615 (2025) 2, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:15.914946Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:6459c03defbbb3854ecddb5018b2f3f85542b9081da67f187049561c2016c567","observation_id":"bab4e334-fae2-4c1e-9a71-35ae3a90e4cb","resolution":{"observed_at":"2026-08-02T20:19:15.914946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15966","last_updated":"2025-10-24T09:35:22Z","snapshot_observed_at":"2026-07-06T21:28:06.120576Z","submitted_at":"2025-05-21T19:35:08Z","title":"Pixel Reasoner: Incentivizing Pixel-Space Reasoning with Curiosity-Driven Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15966","snapshot_observed_at":"2026-08-02T20:19:16.005929Z","title":"arXiv preprint arXiv:2505.15966 (2025) 2, 4, 10, 11","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.005929Z"},"links":{"cited_paper":"/paper/2505.15966","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:c8abc4e32293188663f888f09c07f0c2b087dd47eb4bc18881c06397325b5cc3","observation_id":"9b86dba6-9345-40ce-9ce0-9839901b1dff","resolution":{"observed_at":"2026-08-02T20:19:16.005929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08862","last_updated":"2025-02-10T02:00:10Z","snapshot_observed_at":"2026-08-10T12:00:29.072065Z","submitted_at":"2024-08-16T17:44:02Z","title":"Visual Agents as Fast and Slow Thinkers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08862","snapshot_observed_at":"2026-08-02T20:19:16.095682Z","title":"arXiv preprint arXiv:2408.08862 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.095682Z"},"links":{"cited_paper":"/paper/2408.08862","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:ada8a8c54ee8bbbb72e0e4a2f682ae604f6072fdfe7c016598f887e1ec25012f","observation_id":"6c62dd5c-10f2-4aa4-b1c2-be947ff78a6e","resolution":{"observed_at":"2026-08-02T20:19:16.095682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:16.157561Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.157561Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:7f7aac7d2caeef6fb1247bdb6bc9de025a6792ddb96d51855ebae953f8f2d344","observation_id":"143d14df-d708-49fd-a7df-71a84f4a0bb4","resolution":{"observed_at":"2026-08-02T20:19:16.157561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:16.227084Z","title":"arXiv preprint arXiv:2503.20752 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.227084Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:4ab9e6159062bda7355b2c7a2b11af5badae0d059798892b6515997c6495de03","observation_id":"11d88913-1d6a-4394-b498-33e39fb15602","resolution":{"observed_at":"2026-08-02T20:19:16.227084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-02T20:19:16.299171Z","title":"arXiv preprint arXiv:2403.05530 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.299171Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:9846336c62f4216f5fd30266aa6a152a324ea45b28ab3690711839c567502b37","observation_id":"5c9dc1a0-022a-4fb2-b823-e2cd49efe134","resolution":{"observed_at":"2026-08-02T20:19:16.299171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:16.410124Z","title":"CoRR (2025) 4 18 Authors Suppressed Due to Excessive Length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.410124Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:91a273c30e20058de3365e32a4becf6c2ff231a9e00ddb3010adf543b2e4d9bb","observation_id":"c3bf73b8-b3ca-4dfd-a1f8-e5793b1e7c0f","resolution":{"observed_at":"2026-08-02T20:19:16.410124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:16.508488Z","title":"arXiv preprint arXiv:2507.07999 (2025) 2, 3, 4, 6, 10, 11, 12, 13, 14","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.508488Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:586f86f9543bb5c11147da28a2679bd9da168c93f8b0019bc4965ac965e83c7e","observation_id":"6a2b6f0a-97ea-4a09-a86d-fdaf0821c341","resolution":{"observed_at":"2026-08-02T20:19:16.508488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-02T20:19:16.590114Z","title":"arXiv preprint arXiv:2504.08837 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.590114Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:d629e75de68db9aa301a7b0822f2cc2575848db6236fa0d19d6e4fc95140828f","observation_id":"f5f96ff2-7dd0-4a6a-ab00-8aea76ffae5b","resolution":{"observed_at":"2026-08-02T20:19:16.590114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-02T20:19:16.690981Z","title":"arXiv preprint arXiv:2409.12191 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.690981Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:72af01f87aa89336dd5f5cd1ac799d121d08258e60a79db436b288f9d1628c88","observation_id":"22fac538-a271-4c7e-b86a-b04655c403eb","resolution":{"observed_at":"2026-08-02T20:19:16.690981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:16.745769Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.745769Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:62799e72d66fac0c416d245bd166b9718dd8b8e36a6ca2406acdf85c580c3908","observation_id":"ef794795-c47c-4dfc-8c05-0799626520a4","resolution":{"observed_at":"2026-08-02T20:19:16.745769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12605","snapshot_observed_at":"2026-08-02T20:19:16.874204Z","title":"CoRRabs/2503.12605(March","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.874204Z"},"links":{"cited_paper":"/paper/2503.12605","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:c80919adb14da36ad7a402d81fc2734c058e3d41c452b27edeacb68b04d22adf","observation_id":"9ed547d4-6636-43d8-9c61-649d360de589","resolution":{"observed_at":"2026-08-02T20:19:16.874204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:16.990175Z","title":"https://github.com/huggingface/trl(2020) 10","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:16.990175Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:ced3cbf84b8a907ba2f1771f3de155011403fdeb107cb445e32d26fe12702ed5","observation_id":"43922ca4-75e1-459a-b10f-2757e23e1cc5","resolution":{"observed_at":"2026-08-02T20:19:16.990175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:17.090577Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.090577Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:7ce6a1730b8ad11f6537117fe27ba338bfa9b5b04d503a9c43cb151c566f3322","observation_id":"b1582df3-6712-4497-8b0b-058bfd08d6b4","resolution":{"observed_at":"2026-08-02T20:19:17.090577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-02T20:19:17.169695Z","title":"arXiv preprint arXiv:2412.10302 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.169695Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:acdfd6c56ee092cf8f3048b0ea1a20153d8953bb9540f87247288c75b80876f9","observation_id":"908f4f95-5cbf-4e6e-ba2f-0bece8458d6a","resolution":{"observed_at":"2026-08-02T20:19:17.169695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-02T20:19:17.273507Z","title":"arXiv preprint arXiv:2503.10615 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.273507Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:4e16aa6ef64d7af0fb89a806acc0f04fe8ddafdf770043b3cfecb4b20507dd11","observation_id":"e0737aac-4eb1-4935-a26e-16094a7c31ef","resolution":{"observed_at":"2026-08-02T20:19:17.273507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-02T20:19:17.355558Z","title":"CoRRabs/2408.01800(2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.355558Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:5092326afe89d961045640de25546e0fe5727cd22ee973374b4cc3195632f080","observation_id":"e120ccee-3a35-41fb-b725-164da5ac8017","resolution":{"observed_at":"2026-08-02T20:19:17.355558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04840","last_updated":"2024-08-13T08:10:32Z","snapshot_observed_at":"2026-07-06T18:58:39.334273Z","submitted_at":"2024-08-09T03:25:42Z","title":"mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04840","snapshot_observed_at":"2026-08-02T20:19:17.457027Z","title":"arXiv preprint arXiv:2408.04840 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.457027Z"},"links":{"cited_paper":"/paper/2408.04840","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:84784bc6661d8b8dc9f5c80793f9c04ccf860f06f7388fb65667f04d4cf8c7a7","observation_id":"f85148e9-91de-480b-902b-788e24b75114","resolution":{"observed_at":"2026-08-02T20:19:17.457027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:17.537008Z","title":"Pattern Recognition155, 110714 (2024) 6","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.537008Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:3d3c8047f782f08dc9dd129af98563b2d1dc4941f1e264b369c42f0427ec08e0","observation_id":"beeca18e-d2b1-464b-b1e3-598ecc4e571f","resolution":{"observed_at":"2026-08-02T20:19:17.537008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:17.610498Z","title":"In: Proceedings of the IEEE/CVF International Conference on Com- puter Vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.610498Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:b0c49f638f687e3acf653d907e9dc79ebdb83d702739bfa86652e721746c5224","observation_id":"20d9d905-29ee-4343-b162-a991ad2358e2","resolution":{"observed_at":"2026-08-02T20:19:17.610498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:17.678122Z","title":"CoRR (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.678122Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:478f42d1f5e69fa63d56132ae8c2e9d775ba491b12118c88152730b2778168c8","observation_id":"07127ac1-77b1-4542-bf60-8ba6f0a983cf","resolution":{"observed_at":"2026-08-02T20:19:17.678122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-06T21:34:54.534751Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-02T20:19:17.751573Z","title":"CoRRabs/2503.12937(March 2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.751573Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:fbb7b6925ead924fd0f69aee4ba0fc326cf4991c135f6cc2d64181daf4125808","observation_id":"54ee5f04-205f-48ab-8d41-960dac095b47","resolution":{"observed_at":"2026-08-02T20:19:17.751573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:19:17.819003Z","title":"In: Proceedings of the IEEE/CVF Interna- tional Conference on Computer Vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.819003Z"},"links":{"citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:42c224d8525124b7f0b7bea1f45c179e894c6e50030f3eb16c40ecde926138bc","observation_id":"faf31667-fb50-4a07-b6f3-f211e6fe840c","resolution":{"observed_at":"2026-08-02T20:19:17.819003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08487","last_updated":"2024-06-14T00:52:35Z","snapshot_observed_at":"2026-08-11T01:31:43.600162Z","submitted_at":"2024-06-12T17:59:49Z","title":"Beyond LLaVA-HD: Diving into High-Resolution Large Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08487","snapshot_observed_at":"2026-08-02T20:19:17.878795Z","title":"CoRRabs/2406.08487 (2024) 2, 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.878795Z"},"links":{"cited_paper":"/paper/2406.08487","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:87a95ab9ec6662ab0e90c22fc8231d266504111ad030c34b57cd56a6738018f9","observation_id":"2825c939-e432-4838-a4b1-6456fd772dab","resolution":{"observed_at":"2026-08-02T20:19:17.878795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13257","last_updated":"2025-02-05T08:44:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-23T17:59:51Z","title":"MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13257","snapshot_observed_at":"2026-08-02T20:19:17.934527Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.934527Z"},"links":{"cited_paper":"/paper/2408.13257","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:62018247ef4993c76c0e6a756972c552c1fb7966df04a787125335243cb16b98","observation_id":"4b9c40e3-2f48-44b9-aed1-f197da9f5f74","resolution":{"observed_at":"2026-08-02T20:19:17.934527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18397","last_updated":"2025-07-15T07:32:27Z","snapshot_observed_at":"2026-08-11T05:41:21.038341Z","submitted_at":"2025-04-25T14:48:18Z","title":"Unsupervised Visual Chain-of-Thought Reasoning via Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18397","snapshot_observed_at":"2026-08-02T20:19:17.996747Z","title":"CoRRabs/2504.18397(April 2025) 2, 4, 5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:17.996747Z"},"links":{"cited_paper":"/paper/2504.18397","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:63c31b7444d6da4d794d8755324c8be2461566950c9eee8fc859e30763f254ff","observation_id":"03ad4cbc-e928-44ea-b1f8-b0c945d233cb","resolution":{"observed_at":"2026-08-02T20:19:17.996747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-08-02T20:19:18.067693Z","title":"thinking with images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:18.067693Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:9acdb3c523d05b332cbc0442c416e2e5b4bef47dcd24ea152dc3377fc4e065a2","observation_id":"f53afc1c-bd1e-4e11-a03f-fd6212f5f2d8","resolution":{"observed_at":"2026-08-02T20:19:18.067693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-02T20:19:18.145721Z","title":"arXiv preprint arXiv:2504.10479 (2025) 2, 3, 6, 7, 10, 11, 12, 14","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T20:19:18.145721Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2602.23615"},"observation_digest":"sha256:95245677b7daadab2bd2f19055a583cc708ca9f3824b833bf9f21dbac21c93f8","observation_id":"367c201d-292e-475e-99c8-f71f33b1a26c","resolution":{"observed_at":"2026-08-02T20:19:18.145721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.23615","last_updated":"2026-07-08T09:59:15Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T15:08:39.459637Z","submitted_at":"2026-02-27T02:43:35Z","title":"HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 1 inbound Pith citation observation for arXiv:2602.23615."}