{"as_of":"2026-08-08T15:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37014fc07687de1f97cf7e4b6bbb9af3b6bd817e62ab41ed39e0e25c4d33862e","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:30:17.951658Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05087/citation-record","integrity":"/paper/2506.05087/integrity","json":"/paper/2506.05087/citation-record.json","paper":"/paper/2506.05087"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.800182Z","title":"Subjective and objective measures of streetscape perceptions: Relationships with property value in Shanghai[J]","venue":null,"work_id":"8bb41087-4c03-4a24-b598-844e96b2fc5a","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.591759Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:4c1e8f2df3ec38f99f9545aa932a0af565f938fb7d7352685aab7bcb96b93bad","observation_id":"8f23cc93-8ecd-4cac-905a-0bc2ce7a1f7f","resolution":{"observed_at":"2026-08-07T10:30:20.885116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.619550Z","title":"Research on Urban Street Spatial Quality Based on Street View Image Segmentation[J]","venue":null,"work_id":"64aacd54-7672-4d3a-8577-8fae956222ce","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.606438Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:defa833019f52b06d6f32d71f07700319adf831350056589486a7eaa186c6510","observation_id":"0ffefe2a-e24b-4590-be25-1a69b7e87f27","resolution":{"observed_at":"2026-08-07T10:30:20.673209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.434075Z","title":"Evaluation of Pedestrian-Perceived Comfort on Urban Streets Using Multi-Source Data: A Case Study in Nanjing, China[J]","venue":null,"work_id":"457c6bf0-d508-434f-9cd8-3bba1331c08c","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.613521Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:fccb25163ccda7d732aef767664f4f7c64d6a8c27cb3c15b1c5816a80b5f8f48","observation_id":"586153b6-5ed8-4626-b701-c4566c96f455","resolution":{"observed_at":"2026-08-07T10:30:20.516256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.271398Z","title":"Measuring residents’ perceptions of city streets to inform better street planning through deep learning and space syntax[J]","venue":null,"work_id":"a302d554-5fbe-4d7d-aba9-550bb41d82a3","year":2022},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.621639Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:a75e61a4c001b39ac5bb4266452c87e5cb9c32caffc6dfd775efdc6db1d320ac","observation_id":"a0fc1fec-de7f-4e47-81f6-97a5cd090ac7","resolution":{"observed_at":"2026-08-07T10:30:20.331392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:17.628038Z","title":"Built environment, urban vitality and social cohesion: Do vibrant neighborhoods foster strong communities?[J]","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.628038Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:d5580c59197d19a93ac91cc7226755831043e45d1abb721a30c9a47505b12e69","observation_id":"211023d8-f9b6-49f8-bbfe-b7af71d06848","resolution":{"observed_at":"2026-08-07T10:30:17.628038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00610","last_updated":"2025-03-01T20:34:30Z","snapshot_observed_at":"2026-08-07T17:36:55.116584Z","submitted_at":"2025-03-01T20:34:30Z","title":"Urban Safety Perception Through the Lens of Large Multimodal Models: A Persona-based Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00610","snapshot_observed_at":"2026-08-07T10:30:17.642699Z","title":"Urban Safety Perception Through the Lens of Large Multimodal Models: A Persona-based Approach[J]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.642699Z"},"links":{"cited_paper":"/paper/2503.00610","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:8c85d8e7ef240de63eda8377a98e821835ee36aa01e28f6f6ec987748ebd8c92","observation_id":"7add6a18-48e9-425d-95e7-4c8f844836bc","resolution":{"observed_at":"2026-08-07T10:30:17.642699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.072357Z","title":"Streetscape Analysis with Generative AI (SAGAI): Vision-Language Assessment and Mapping of Urban Scenes[J]","venue":null,"work_id":"5565f323-d3a1-42b8-8ab1-7e6d8cf25635","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.654296Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:1108596b769e4acf43775dceed1d98712a011a221861ef235edf368e6f414fa0","observation_id":"e94093e7-28ea-4ce9-bb39-4fd9b508f78d","resolution":{"observed_at":"2026-08-07T10:30:20.159918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.883318Z","title":"Quality of public space and sustainable development goals: analysis of nine urban projects in Spanish cities[J]","venue":null,"work_id":"1206449d-58dc-4af5-b15e-82fa13ac0c4a","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.665433Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:ca2a648a32f866af20f9b0b820db03f534fb052ab550fa7f729c16b504e8f41e","observation_id":"1c318adb-ff10-4628-b33a-cd2f7a0a1b21","resolution":{"observed_at":"2026-08-07T10:30:19.985491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:17.674570Z","title":"Assessing street-level urban greenery using Google Street View and a modified green view index[J]","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.674570Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:3f5822a12049cc63c6a061176537b382d9bdd71655e029d7b15c29baacc12566","observation_id":"cc7feeb7-2fc1-4395-b597-fce92e40098b","resolution":{"observed_at":"2026-08-07T10:30:17.674570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.643142Z","title":"Streetscore-predicting the perceived safety of one million streetscapes[C]//Proceedings of the IEEE conference on computer vision and pattern recognition workshops","venue":null,"work_id":"5eb194ea-c5e2-44ac-b5c2-6669681c1dd2","year":2014},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.683794Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:44a7e0e8981fb3c7b127f086a49d9efff0d4fc76b7001c16844da8e372efb7c2","observation_id":"89a5e99c-a502-4e33-85c8-024a79a24de7","resolution":{"observed_at":"2026-08-07T10:30:19.732083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.238591Z","title":"The digital life of walkable streets[C]//Proceedings of the 24th international conference on World Wide Web","venue":null,"work_id":"ed833ac0-a1bc-4c8d-ad09-eb0b14a5f6d7","year":2015},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.696835Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:a78bd1cd423bb0d1e53baba86c8522067831a6da37f0bd6b0d4173c92fe1fe16","observation_id":"0b2af42d-0755-4c14-b3d7-8c261bbd95b2","resolution":{"observed_at":"2026-08-07T10:30:19.317537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.935793Z","title":"Sustainability, Creativity, and Livability in Great East Asian Megacities: Insights from Twenty-First Century Tokyo, Seoul, and Chinese Creative Clusters[J]","venue":null,"work_id":"d514709b-d955-477c-a76b-da3e0079f130","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.708774Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:5910717e386435be5f7431b89ad19091e7e9611c23117bcb87167ffa05b9e82c","observation_id":"6012157b-d1f0-47b9-bab0-0c051665a7cd","resolution":{"observed_at":"2026-08-07T10:30:18.983586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.903332Z","title":"Gender, fear and the night-time city[M]//Fair Shared Cities","venue":null,"work_id":"94576bc9-b533-49f3-9458-f687a6b89123","year":2016},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.714316Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:07c2ac60df722029061acb5a9154cc5e036cee94920bc1198c4b8be70cb58981","observation_id":"16cea47e-95e8-4d6b-b1dc-8f934deff5b2","resolution":{"observed_at":"2026-08-07T10:30:18.916221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.835414Z","title":"The shortest path to happiness: Recommending beautiful, quiet, and happy routes in the city[C]//Proceedings of the 25th ACM conference on Hypertext and social media","venue":null,"work_id":"1ee3edc4-8ee9-4325-aae4-55603bfd1424","year":2014},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.727414Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:b79668a6337466469518d59fd5f9658e09b161d3bf48bc5b1723f4c2ac236aad","observation_id":"482cccc9-b68a-41c2-8dc5-d33ba7292777","resolution":{"observed_at":"2026-08-07T10:30:18.846947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.070167Z","title":null,"venue":null,"work_id":"695be345-3ba6-4b3e-8c43-78466ec5e075","year":2016},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.732939Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:afa4795fc00f7aa27d877c96db0263b8e4311bd01abcfe8693a0b07af50ef0ce","observation_id":"3a38a8de-cca4-4713-8698-6436e7e67758","resolution":{"observed_at":"2026-08-07T10:30:19.145096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.798957Z","title":"The city and the car[J]","venue":null,"work_id":"59771356-95a8-450b-80eb-41d7e4cefaca","year":2000},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.740838Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:53faa25df4a13d6b8bf648818371485ccc4b5e327354edfbdf8b1cc0b00d6de8","observation_id":"6772f86d-5aac-4784-921a-4f30ec87b752","resolution":{"observed_at":"2026-08-07T10:30:18.815761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.432077Z","title":"Assessing the level of walkability for women using GIS and location-based open data: The case of new york city[J]","venue":null,"work_id":"a98b3cf8-9864-4f32-9648-f2161226050b","year":2021},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.748609Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:2e6d15d2303c7b756ec2de88871e366d9e376f2f171ff97ba142435a925e6835","observation_id":"22d08d9e-4f10-41d3-baa9-9f3718778a17","resolution":{"observed_at":"2026-08-07T10:30:19.518768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.747528Z","title":"How to study public life[M]","venue":null,"work_id":"0a39b4f1-bf8d-40e1-9321-873717b54abc","year":2013},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.758559Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:7d4a81521a04574ed6448d74eb19aad563d34c3aa137ea06f1dd9567fe4c13aa","observation_id":"e95bd789-34f1-4a6f-ac72-acb2f9d18d12","resolution":{"observed_at":"2026-08-07T10:30:18.762615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.715346Z","title":"Effects of skeletal streetscape design on perceived safety[J]","venue":null,"work_id":"13a1af80-e4f0-4941-b6eb-c7833701eb2b","year":2015},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.765476Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:e80966294f2c7f71eec3388a4532b822e95032e49396ec08fc27ad0734f1dcb5","observation_id":"1cc5d86a-7ac8-4606-a3a5-3631848019f9","resolution":{"observed_at":"2026-08-07T10:30:18.724268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.686902Z","title":"Dynamic Urban Imagery and Emotional Perception in Shanghai's North Bund: A Deep Learning Approach[J]","venue":null,"work_id":"82fecf02-d25c-46c3-aa52-a6e90759ca63","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.774633Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:2158a43c7f58c78d353e2d054b4eda91fa1afa1f5f4c1bdbdfd1ac8e93e279e3","observation_id":"93ce5d3a-606e-4c6d-91a7-57eb914e986b","resolution":{"observed_at":"2026-08-07T10:30:18.694829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.659086Z","title":"Exploring the coherence and divergence between the objective and subjective measurement of streetscape perceptions at the neighborhood level: A case study in Shanghai[J]","venue":null,"work_id":"56ed9799-8f6a-4fcb-a2c9-3264c8abcd28","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.784171Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:0327eff5aec2d07fe512af107f74a45248e329c29f100eb290feddb9ff0a8ede","observation_id":"c06902ed-5125-43ba-b50c-97ffb3e85222","resolution":{"observed_at":"2026-08-07T10:30:18.668311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.867383Z","title":"Standardized green view index and quantification of different metrics of urban green vegetation[J]","venue":null,"work_id":"c6fb1674-474a-44ba-8866-e585f72acab0","year":2020},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.791064Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:cb2eed4c1eb79ee061e0ca705d03db6215c4f8b5ebf74e2aa14577e2a79a8f7c","observation_id":"cd5be308-a7bd-480b-b99f-7d5f95b4f895","resolution":{"observed_at":"2026-08-07T10:30:18.880420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.631454Z","title":"Urban greenery and mental wellbeing in adults: Cross-sectional mediation analyses on multiple pathways across different greenery measures[J]","venue":null,"work_id":"4c807b0a-9e39-464f-b262-503979290444","year":2019},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.796683Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:9a1d161d2bbb0c29c5e069570fee3360eed76a8e53ea3d451f843620ebd87647","observation_id":"7e7164dd-67d1-4f5c-abdc-4ee292dcbaa7","resolution":{"observed_at":"2026-08-07T10:30:18.640872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.602036Z","title":"Determinants and effects of perceived walkability: a literature review, conceptual model and research agenda[J]","venue":null,"work_id":"481aeebe-de66-4ab2-8393-7159675e7767","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.802649Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:4524eb2b71ca491b61870f5d497241d71df5c40ca367e47532ce493fa8b87b11","observation_id":"05bfdda7-0ffb-46cb-af05-7eadc9cfd989","resolution":{"observed_at":"2026-08-07T10:30:18.608087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.578409Z","title":"How to Construct an Urban Color System? Taking the Historic Center of Macau as an Example[J]","venue":null,"work_id":"a51b2146-6f95-4087-800e-62cd19905684","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.812224Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:6de48b9ea18f24edeb470edf58e1ff5676ad39e45881d1d4e8b0266ffa184b78","observation_id":"98f647ac-a69b-4e6c-8b0f-3a9735bab58d","resolution":{"observed_at":"2026-08-07T10:30:18.585287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.551731Z","title":"Learning transferable visual models from natural language supervision[C]//International conference on machine learning","venue":null,"work_id":"449af835-7987-4bab-ba6c-761008286ce5","year":2021},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.820388Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:0c684e59e41272059b6d1f5c658ccb1a94f65a325c0e7e09d2b544994994f551","observation_id":"f76a20af-fa76-4de3-94c9-96fcb3c58350","resolution":{"observed_at":"2026-08-07T10:30:18.562157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.518026Z","title":"Urbanclip: Learning text-enhanced urban region profiling with contrastive language-image pretraining from the web[C]//Proceedings of the ACM Web Conference 2024","venue":null,"work_id":"137a61a7-5a37-4cd3-8ed9-2c280068db9f","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.827102Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:393e38ddba8a111387f6113899d06d114fa7e2c719c7dc4c0b8654247a6c1b56","observation_id":"f33507ed-bade-407b-9aa7-9b4c3e73f524","resolution":{"observed_at":"2026-08-07T10:30:18.526974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.490912Z","title":"Uncertainties of human perception in visual image interpretation in complex urban environments[J]","venue":null,"work_id":"c90d7bcd-68fe-451e-84ba-e2844b4bc08b","year":2020},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.833960Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:737df2f6ca3bb576576df52f9409923488d413b14a578bd6e31a19e566ce47f8","observation_id":"d99a1b4f-6511-47bf-9241-496aa5f436db","resolution":{"observed_at":"2026-08-07T10:30:18.502474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.455686Z","title":"Exploring the impact of urban built environment on public emotions based on social media data: a case study of Wuhan[J]","venue":null,"work_id":"696cee46-947d-4a85-a31e-751e18d7a973","year":2021},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.844566Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:6d3a4b0287e6389f96825c4ba6aab55225b30373b86e4aaf2c0f413277c8926b","observation_id":"e3f4eecc-2724-4e03-a75d-9b7d8263f36a","resolution":{"observed_at":"2026-08-07T10:30:18.466832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.429387Z","title":"Quantitative land price analysis via computer vision from street view images[J]","venue":null,"work_id":"8b2e1324-349e-48b6-96a5-3d491ec78922","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.856908Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:447b122d762cf7d602172a12f20daa698e84a665e9a410d3019b21fe3bd26245","observation_id":"1350cd71-0a83-4f15-aa30-b182e943583f","resolution":{"observed_at":"2026-08-07T10:30:18.435972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.396270Z","title":"Evaluating the subjective perceptions of streetscapes using street-view images[J]","venue":null,"work_id":"7fc09b1f-62fd-47fa-848d-f99da862d946","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.869916Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:04d2faa347fd9cbb113b36e173132d45279ccafd17c95181652b041dd40df139","observation_id":"2a7599a0-54b9-4e13-8691-22a47d076222","resolution":{"observed_at":"2026-08-07T10:30:18.404604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.350483Z","title":"Timechat: A time-sensitive multimodal large language model for long video understanding[C]//Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"8fb6e7d7-0803-4d89-a58f-24368ef0aa44","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.877854Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:bbfef829ecb82b7fd4e2690327a94b9a61cee4cd0d4bd178813934e7c8115c87","observation_id":"0f6ee772-4304-4c58-b557-32d84c6c0b5c","resolution":{"observed_at":"2026-08-07T10:30:18.364618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14268","last_updated":"2024-06-29T10:32:58Z","snapshot_observed_at":"2026-07-06T18:49:02.371640Z","submitted_at":"2024-06-29T10:32:58Z","title":"Urban Visual Appeal According to ChatGPT: Contrasting AI and Human Insights","version":1},"cited_work":{"arxiv_id":"2407.14268","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14268","snapshot_observed_at":"2026-08-07T10:30:18.160956Z","title":"Urban Visual Appeal According to ChatGPT: Contrasting AI and Human Insights","venue":"cs.HC","work_id":"bfbceb27-14c8-4753-b4f7-27a3203f879e","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.883889Z"},"links":{"cited_paper":"/paper/2407.14268","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:3267cc53335032ee9b04bc55adcc8f00ec96dfcd114902277b041aeb168c7c53","observation_id":"2b006c46-cd77-42a2-8bdd-06589dae9f08","resolution":{"observed_at":"2026-08-07T10:30:18.169482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.320305Z","title":"Multimodal Spatio-Temporal Data Visualization Technologies for Contemporary Urban Landscape Architecture: A Review and Prospect in the Context of Smart Cities[J]","venue":null,"work_id":"72ca4a19-137b-4fb8-9b14-2d2711871193","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.891397Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:c4e92faf941c9ca7105ed8fb40b5c8c9623297b012cefbd6496e3e456c1ba16e","observation_id":"c6cbe191-bb83-4a9f-9a48-7c6c95a988ce","resolution":{"observed_at":"2026-08-07T10:30:18.328326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14476","last_updated":"2024-11-19T05:15:19Z","snapshot_observed_at":"2026-07-06T19:54:00.822571Z","submitted_at":"2024-11-19T05:15:19Z","title":"StreetviewLLM: Extracting Geographic Information Using a Chain-of-Thought Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14476","snapshot_observed_at":"2026-08-07T10:30:17.896560Z","title":"StreetviewLLM: Extracting Geographic Information Using a Chain-of-Thought Multimodal Large Language Model[J]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.896560Z"},"links":{"cited_paper":"/paper/2411.14476","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:4e57dbc6480fe2bd9ff03c10f4659bacfa374ad6c29b0a207a31522c18afbbcf","observation_id":"08abf6c2-e97b-408c-9e04-15abe509be24","resolution":{"observed_at":"2026-08-07T10:30:17.896560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16326","last_updated":"2025-03-20T16:45:48Z","snapshot_observed_at":"2026-08-07T16:48:37.625471Z","submitted_at":"2025-03-20T16:45:48Z","title":"OmniGeo: Towards a Multimodal Large Language Models for Geospatial Artificial Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16326","snapshot_observed_at":"2026-08-07T10:30:17.905841Z","title":"Omnigeo: Towards a multimodal large language models for geospatial artificial intelligence[J]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.905841Z"},"links":{"cited_paper":"/paper/2503.16326","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:70b000eb3584909d57807a237f1c7a860e9d5a788e2e0d83aa707e13067a8b14","observation_id":"d3bf2d5d-84c2-4123-879f-89b4156e35f8","resolution":{"observed_at":"2026-08-07T10:30:17.905841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08810","last_updated":"2024-10-14T07:43:05Z","snapshot_observed_at":"2026-07-06T19:31:49.052556Z","submitted_at":"2024-10-11T13:47:53Z","title":"LIME-Eval: Rethinking Low-light Image Enhancement Evaluation via Object Detection","version":2},"cited_work":{"arxiv_id":"2410.08810","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.08810","snapshot_observed_at":"2026-08-07T10:30:18.064105Z","title":"LIME-Eval: Rethinking Low-light Image Enhancement Evaluation via Object Detection","venue":"cs.CV","work_id":"40bc72ee-3caf-4d8c-902a-b155ca8ea1f1","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.914004Z"},"links":{"cited_paper":"/paper/2410.08810","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:9a74f2244288127f081027f207b2405136631849301b105b88471bc5e68eff91","observation_id":"0ccf12fb-b0dc-4fb6-8405-adf9b685ba2d","resolution":{"observed_at":"2026-08-07T10:30:18.070654Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.280366Z","title":"Urbangpt: Spatio-temporal large language models[C]//Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining","venue":null,"work_id":"881db347-9684-4eb7-bbd7-b2dc07609d4e","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.923358Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:bfd7d301b5322d5143faa97159c37b4564d2c7314338754997f17d38c9f6263b","observation_id":"5dce882b-1cee-4eeb-9f82-274ff2d7c3df","resolution":{"observed_at":"2026-08-07T10:30:18.290346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.249365Z","title":"UrbanMLLM: Joint Learning of Cross-view Imagery for Urban Understanding[J]","venue":null,"work_id":"9b90d243-d3d2-4386-a87f-59bfb4b3adc2","year":null},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.930567Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:873522cf4ae2a140aec3fd9520b94c0d9afd7e90b21de440fddc3e8e160a8561","observation_id":"bffa4a61-5ec0-4b87-8013-398f593de7c6","resolution":{"observed_at":"2026-08-07T10:30:18.263594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19719","last_updated":"2025-06-02T05:10:45Z","snapshot_observed_at":"2026-07-06T18:53:09.559588Z","submitted_at":"2024-07-29T06:03:13Z","title":"Urban Safety Perception Assessments via Integrating Multimodal Large Language Models with Street View Images","version":3},"cited_work":{"arxiv_id":"2407.19719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.19719","snapshot_observed_at":"2026-08-07T10:30:18.020857Z","title":"Urban Safety Perception Assessments via Integrating Multimodal Large Language Models with Street View Images","venue":"cs.CV","work_id":"e39c625c-dac8-4234-a958-1caa1f9df8fe","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.943253Z"},"links":{"cited_paper":"/paper/2407.19719","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:73fb633c788740d84023b1b7ee2b91a2049b46136c97144cfcc9247a9469885f","observation_id":"1e0ab817-33c6-45e4-b062-30f963ffebae","resolution":{"observed_at":"2026-08-07T10:30:18.032377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.226212Z","title":"Situation awareness in ai-based technologies and multimodal systems: Architectures, challenges and applications[J]","venue":null,"work_id":"0a5f1ed6-3cba-4aa4-aa11-78659fbd7772","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.951658Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:11fe2fbfc5182a700f09b2d31064209bbbb22366077ca6341e66e15691268ad7","observation_id":"21630693-04c5-4b35-9e32-0efc999bf7d1","resolution":{"observed_at":"2026-08-07T10:30:18.233234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:22:38.205324Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":3,"verified_fuzzy":32},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2506.05087."}