{"as_of":"2026-08-15T16:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a53f29094d0e1c473212896496b89e68208e49afda98e21358bdc360aa47b063","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:14:38.122080Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10195/citation-record","integrity":"/paper/2608.10195/integrity","json":"/paper/2608.10195/citation-record.json","paper":"/paper/2608.10195"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.878852Z","title":"Bendeck and J","venue":null,"work_id":"b129c203-cd18-47d0-b840-3c519182d251","year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.897219Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:4fff75a93db3ff43a551bee66ac8dfb3f86ba37307be72e7eafa267dcaf2acb6","observation_id":"8003a1bd-a7cc-4540-a410-1285504b921d","resolution":{"observed_at":"2026-08-14T04:14:38.885055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.861634Z","title":"Binz and E","venue":null,"work_id":"85a8d885-6e6c-4ea4-8907-9d5e8036f02a","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.902729Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:b7c7d4a1548c130773da55a61bf5cfb9fd87403326e4f73a8d40a4a69ff60788","observation_id":"bbc6b384-7ea6-4290-8085-cd8e54ad2ff7","resolution":{"observed_at":"2026-08-14T04:14:38.866855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.843984Z","title":null,"venue":null,"work_id":"8c09a459-4f6b-4c4f-8e37-9e93b51d09b3","year":1984},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.909397Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:0453cd31b58d7aa9689760d412cf1897181ba0608ab9ab53e01d0244ce6a3d9b","observation_id":"a6d71381-1f3d-46b7-a457-77ee7de5e297","resolution":{"observed_at":"2026-08-14T04:14:38.848995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.824518Z","title":null,"venue":null,"work_id":"272f85ac-6655-4dc7-93fa-e4caca771c13","year":1960},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.915600Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:523c561201e8ac56ecfb3dee9c64a579581e26f4cc2d800ad951233f95afe5d6","observation_id":"f383a65a-ded5-403c-8085-e062dff95d77","resolution":{"observed_at":"2026-08-14T04:14:38.829690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.806194Z","title":"Demiralp, M","venue":null,"work_id":"553ada22-f1cb-4285-be24-a8247529b186","year":1933},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.921063Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:c5c4a6256447cb05bc76e377b1285b3223d2840e251eda272c0b487b6358fe7b","observation_id":"df26e7ad-f3c8-4edd-b446-5c7b8325e347","resolution":{"observed_at":"2026-08-14T04:14:38.811372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.786248Z","title":"Geirhos, K","venue":null,"work_id":"24660aab-4fa7-4e6c-96e8-a79be9d3a6d5","year":2020},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.925985Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:651f7b060b2e03f1475c4af2f7b29a2b05a0188f169cf2ff916dafb9034d398d","observation_id":"ba55ed49-17df-4a4a-9726-8587fb0bdf7c","resolution":{"observed_at":"2026-08-14T04:14:38.792345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.768611Z","title":"Geirhos, K","venue":null,"work_id":"4b999937-9abc-45dc-b72d-14e8a7e23c83","year":2021},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.931234Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:6d54dd0c8de3ad0ab7bfb4506b79ded74d83f4d3517c8881509612efe6bd2686","observation_id":"6aff5982-771e-47f5-b525-ce1cd9568cfa","resolution":{"observed_at":"2026-08-14T04:14:38.773721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.750941Z","title":"Geirhos, P","venue":null,"work_id":"587ee79b-c290-45f6-a1e6-769afe840e18","year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.937677Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:0282b57da91d57e6e1ab61e6f53b3c5e822afed9c10b9dddfc318dcacc9a7d74","observation_id":"2643d56f-e007-49dd-85bb-ede25b75a62c","resolution":{"observed_at":"2026-08-14T04:14:38.756957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.717701Z","title":null,"venue":null,"work_id":"b503458f-ae36-4221-b1b9-9de58a127f40","year":1953},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.947482Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:e332ecb16f3fe629e5f997272c2528c2dcd3f9cfe68316dd447900fa6abca5ba","observation_id":"53a600c6-8635-4f45-85fc-b31d3d2b4550","resolution":{"observed_at":"2026-08-14T04:14:38.730429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.696438Z","title":"Haehn, J","venue":null,"work_id":"973ef553-1299-4891-97ba-eacc2ec9c94b","year":2019},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.952396Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:6c3b7b3a1e76da5503debe58f419335e9cc5f52805c309e51d5f6971895670e4","observation_id":"1d5642a6-2a8d-42b4-b4b4-493829bbb334","resolution":{"observed_at":"2026-08-14T04:14:38.704440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.677940Z","title":null,"venue":null,"work_id":"22cf87c8-58d0-482e-91c9-7d18c4d3e80f","year":2022},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.957292Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:b684537bdc6032630102a1ed3913d338170a2cd4461b5586bf0c7417fbe92390","observation_id":"86b1f758-cd3c-4cc9-a35a-78efd74f4ba7","resolution":{"observed_at":"2026-08-14T04:14:38.682992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.661387Z","title":null,"venue":null,"work_id":"2042f050-11ac-4a85-b014-d3279d2c2bb7","year":1996},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.962228Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:ec8814748d3354845d0a2c24ff31ca7200d5765acb47c23e7976320eb3edcafa","observation_id":"915b78b7-475a-4540-b0c7-8738a60e3de8","resolution":{"observed_at":"2026-08-14T04:14:38.666290Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.643890Z","title":null,"venue":null,"work_id":"32b87c22-7c94-44c8-8fc0-1bd39fa2ee9a","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.967043Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:6468280a306343ba17de5c4a1ef436872aa838ea59b8abc7426a1d5a59af3525","observation_id":"d689d506-4cb6-4a78-a90c-1ec9c144b952","resolution":{"observed_at":"2026-08-14T04:14:38.648788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.620124Z","title":null,"venue":null,"work_id":"6c7b33d6-6f72-4107-aa53-6f0ca2b68150","year":2020},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.975248Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:f928ec562eae3100c7efcf60aa3a9950346a22112cd84051b51afb5f347bcec0","observation_id":"62c86f26-e75f-4326-8da9-2e8ee8c4bb8c","resolution":{"observed_at":"2026-08-14T04:14:38.627008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.603299Z","title":"Heer and M","venue":null,"work_id":"e3b70de1-0d35-4b75-bf53-ce69ccc76445","year":2010},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.980014Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:fdbaaff37d68e021e82d4de3c9a6beab3a714ed54af09259711c604ecffb6005","observation_id":"d9262281-f6e0-41e4-8a61-c5024aa36cd6","resolution":{"observed_at":"2026-08-14T04:14:38.608425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00718","last_updated":"2025-05-31T21:35:54Z","snapshot_observed_at":"2026-08-14T05:12:40.702351Z","submitted_at":"2025-05-31T21:35:54Z","title":"From Local Cues to Global Percepts: Emergent Gestalt Organization in Self-Supervised Vision Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00718","snapshot_observed_at":"2026-08-14T04:14:37.988960Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.988960Z"},"links":{"cited_paper":"/paper/2506.00718","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:1dbca886bfe6a4fa156f1ff52df2b33654dc8c2d57c777aca020ab099bcd7572","observation_id":"21574dc7-b5be-4395-a037-89bd62271167","resolution":{"observed_at":"2026-08-14T04:14:37.988960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.583192Z","title":null,"venue":null,"work_id":"7e99264d-4463-4b04-aa8b-b0d29c4a2385","year":2024},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.994422Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:0dab1bf51652b395e107a0e8ae09f05a74c04aec2d8910f687679162f45d0896","observation_id":"2013f4fc-ca9d-4fb5-befb-64c7bc66cfa4","resolution":{"observed_at":"2026-08-14T04:14:38.587991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05299","last_updated":"2025-04-07T17:58:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T17:58:57Z","title":"SmolVLM: Redefining small and efficient multimodal models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05299","snapshot_observed_at":"2026-08-14T04:14:37.998915Z","title":"Marafioti, O","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.998915Z"},"links":{"cited_paper":"/paper/2504.05299","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:62f893d4936aaa5571b7656e42e629fa97058a776e8ba1bc45d54266130ddcf9","observation_id":"5a21eed5-ac60-4de2-b91b-46625c3f6323","resolution":{"observed_at":"2026-08-14T04:14:37.998915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.566803Z","title":"Masry, D","venue":null,"work_id":"7fe0fc75-910d-4b96-b02e-8202ebf61cc7","year":2022},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.004300Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:82fe30b3734fad5fadfe5a4cda690d07a86d36900edf764e101a43137418aea2","observation_id":"244e7378-d31f-41d9-860d-2e01116163f3","resolution":{"observed_at":"2026-08-14T04:14:38.571791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.552522Z","title":null,"venue":null,"work_id":"8de073cd-bd16-4124-8b42-7c5c49dfaa77","year":2022},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.008784Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:d8c73945cd236fa8f00432b53779096792e4b5edbb2fcf5e281cdeae2e62e9d5","observation_id":"bc9019f6-3999-4abb-bbb9-3fd8a5ba1f82","resolution":{"observed_at":"2026-08-14T04:14:38.556611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.533452Z","title":"Muttenthaler, J","venue":null,"work_id":"4b3d4942-1ba9-4021-8fd0-81288ebf7c2c","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.013596Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:bf5afdd699f0212d510785fa09e1065caf713726bbc35e3c1b793f40685941c2","observation_id":"65053c9f-4cbf-4851-9097-66b4b5444041","resolution":{"observed_at":"2026-08-14T04:14:38.537850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.514280Z","title":"Oquab, T","venue":null,"work_id":"88ea4f6d-ac22-4222-bf89-2bafdccdcfd3","year":2024},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.017979Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:1b73e0b79ed95ab960a5132f740c1e2b6a97ebb747d18c7057e4cdc3be768f24","observation_id":"314ce5e3-4529-4dbd-958b-2c0e1d2fd976","resolution":{"observed_at":"2026-08-14T04:14:38.519449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.493082Z","title":"Pandey and A","venue":null,"work_id":"7bcdbaf7-8723-4634-8254-190bf8fba81c","year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.027031Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:a887c5871a421a0d64373e759222083c73e09e7a0b22b5a8278feebd446714b0","observation_id":"9cbf151d-9884-4ab6-8dba-e2845f2c905b","resolution":{"observed_at":"2026-08-14T04:14:38.501733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.477605Z","title":"Radford, J","venue":null,"work_id":"38a80425-e871-4b55-bcf0-7f94b02c24b9","year":2021},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.037183Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:af7fff732a634295891b6678066781ae4a5e9082dd8872761ccde9758046edb7","observation_id":"ac8c85d5-9f12-42bc-ab1c-5195f5d3c7fe","resolution":{"observed_at":"2026-08-14T04:14:38.482379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.461362Z","title":"Schrimpf, J","venue":null,"work_id":"c5b91911-c7fa-42bc-9ba4-30ae10e67c08","year":2020},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.042371Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:95ac56d477c327e9d4024b58b7d452cd82e00ef3b688bda78b35bc36dfd15f4e","observation_id":"98b8af51-3410-4b50-9a57-35f19caae153","resolution":{"observed_at":"2026-08-14T04:14:38.466240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.444602Z","title":null,"venue":null,"work_id":"66bc26f1-3cb1-4f62-ab0f-93c0b5b20745","year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.047565Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:1bb89051f74ac8b3e1538676292ab9d062b740045e1a018fd46c878384582d9f","observation_id":"c744dfbe-bfab-4fa7-a1f5-f39d9955ba79","resolution":{"observed_at":"2026-08-14T04:14:38.450294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.429944Z","title":"Skau and R","venue":null,"work_id":"0a3f6a70-cc21-47a2-bb66-bfcd775cb370","year":2016},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.052526Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:3b8df0bbc9875e04df31028d0215d1e974a5b8c5d7854fd20acf5dd87790d12f","observation_id":"f9fe5922-6d20-46a8-ac82-5142187febb2","resolution":{"observed_at":"2026-08-14T04:14:38.434329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13018","last_updated":"2024-11-26T10:31:41Z","snapshot_observed_at":"2026-08-13T20:59:28.725867Z","submitted_at":"2023-10-18T17:47:58Z","title":"Getting aligned on representational alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13018","snapshot_observed_at":"2026-08-14T04:14:38.058262Z","title":"Sucholutsky, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.058262Z"},"links":{"cited_paper":"/paper/2310.13018","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:8c3cbdab2343d78d046f63b8cf488356565c966fa92daca9f7d277867ba40a1d","observation_id":"8dde479d-b5c5-419d-b567-e096fb5b740e","resolution":{"observed_at":"2026-08-14T04:14:38.058262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.413262Z","title":null,"venue":null,"work_id":"f0d8a126-731e-42e4-a493-e474766e0fee","year":2018},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.063570Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:1333c4a4910479359d35bc71a4c92ca88ad6166c6a1a4d0a48155f71b8c0cf11","observation_id":"48014051-31ba-498c-9fc9-2060948ed58f","resolution":{"observed_at":"2026-08-14T04:14:38.417712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.398702Z","title":"Talbot, V","venue":null,"work_id":"05de1a01-9d00-49ff-96e9-aeef76586c00","year":2014},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.068278Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:bd38f13e7f2f47b8ff6d74609c425550ea64dcf906b3650fbe40169445a46fab","observation_id":"97f3c624-9d0c-49e9-a7b3-87e6cb03ba6e","resolution":{"observed_at":"2026-08-14T04:14:38.402928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.383448Z","title":"Torfs, K","venue":null,"work_id":"c41abfab-9a64-4d3e-b2de-7d313b63d259","year":2014},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.072850Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:7d2c26bcbb80662ddbb5439878beb328afe9c374b9ff79f2f90dfce420eff1bd","observation_id":"6ed0fbfa-7464-4e1f-af7d-ea07237e324a","resolution":{"observed_at":"2026-08-14T04:14:38.388312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.366979Z","title":"Tseng, A","venue":null,"work_id":"3a595cc5-8531-425c-ac9e-a666dc899e14","year":2024},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.077279Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:ab26228ef10d7ce0c4ce49674da83d7561839ce72183eb660223b02f78f6bc53","observation_id":"5de745d3-bf06-48a2-abe2-bccb48983418","resolution":{"observed_at":"2026-08-14T04:14:38.372427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17202","last_updated":"2025-05-22T18:15:04Z","snapshot_observed_at":"2026-08-14T01:51:07.013368Z","submitted_at":"2025-05-22T18:15:04Z","title":"CHART-6: Human-Centered Evaluation of Data Visualization Understanding in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17202","snapshot_observed_at":"2026-08-14T04:14:38.082018Z","title":"Verma, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.082018Z"},"links":{"cited_paper":"/paper/2505.17202","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:44583fb458baf814ae015d11664918895ffe11d15a227a3e31d4535fc4bdf827","observation_id":"1fc2a428-9bde-45ce-a174-423774fcc281","resolution":{"observed_at":"2026-08-14T04:14:38.082018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-14T04:14:38.087144Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.087144Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:53de1336f4ed6b81d3ada5207100aa14dc0ab89f1682752c23389057132498b9","observation_id":"9b42d781-938b-419b-9721-62f63197e5ce","resolution":{"observed_at":"2026-08-14T04:14:38.087144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.350135Z","title":"Ware.Information Visualization: Perception for Design","venue":null,"work_id":"2125c06a-3785-4ba5-9e8b-84ccf85f2488","year":2013},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.092237Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:1978ed1f828992ff6b588813282e68246874272d73347ad9e8dcc96fa24f7892","observation_id":"07fef077-96e3-4237-9552-ebad55dd76c1","resolution":{"observed_at":"2026-08-14T04:14:38.355465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.333242Z","title":"Wertheimer","venue":null,"work_id":"62659d9d-beec-46e9-9cbb-0387d8fee697","year":1923},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.097131Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:f7c85012e52b7d553ef3b55c8227217a0d8a875b44ab512517671ebfc5b6d30a","observation_id":"0cdd7994-cd88-4a19-9e95-c2849d0f19a4","resolution":{"observed_at":"2026-08-14T04:14:38.338035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.317101Z","title":"Whitney and A","venue":null,"work_id":"d77bacdc-6063-4881-9c8b-4808e7a31192","year":2018},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.102974Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:c6bc11dfba7bdac6c21d2050bafa4d36e9330762dfe981722f470226bc5f4f8f","observation_id":"a32259af-0692-423b-ab71-6de428ddd02f","resolution":{"observed_at":"2026-08-14T04:14:38.322320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.299918Z","title":null,"venue":null,"work_id":"91de1767-fce8-4ecd-9941-34dac9ab33a9","year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.107644Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:7df971ef82d5f45c5db21e531b1af7c44a9067bac469ab8fa89ac806bb4d048f","observation_id":"fec9a85d-df09-458d-ac13-cf87d3a2c9af","resolution":{"observed_at":"2026-08-14T04:14:38.304782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.283078Z","title":null,"venue":null,"work_id":"f6e81c81-d907-4a8f-bd7b-4cabd03456ee","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.112264Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:e99750b7b1b80e79db79967472f901652e3a02103af743412080002b1d6a916b","observation_id":"a51d41d3-0f6c-402b-a9fa-f98a2a7d4316","resolution":{"observed_at":"2026-08-14T04:14:38.287882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10857","last_updated":"2025-03-13T20:13:39Z","snapshot_observed_at":"2026-08-14T07:36:52.444195Z","submitted_at":"2025-03-13T20:13:39Z","title":"Towards Understanding Graphical Perception in Large Multimodal Models","version":1},"cited_work":{"arxiv_id":"2503.10857","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.10857","snapshot_observed_at":"2026-08-14T04:14:38.160962Z","title":"Towards Understanding Graphical Perception in Large Multimodal Models","venue":"cs.GR","work_id":"23844d30-7db4-4f34-ae50-5cdafc452942","year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.116892Z"},"links":{"cited_paper":"/paper/2503.10857","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:8e8c60ce0501f8ee06ed19f9eb9027dc5b4cae36db87553f653af57451889cbe","observation_id":"a55ac8e0-b553-499d-a937-3da38a54b075","resolution":{"observed_at":"2026-08-14T04:14:38.167801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.267011Z","title":"trial_id","venue":null,"work_id":"dcb28b61-3e4c-49f4-99bc-2bf03a467713","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.122080Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:5237404e5f3eef499b641cd3ea4d4cd7d159e56970e5e7d248d8e7230a8cc5cb","observation_id":"a8004356-457c-45e3-920e-bb0cedb3c866","resolution":{"observed_at":"2026-08-14T04:14:38.271926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T23:10:17.265467Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2608.10195."}