{"as_of":"2026-08-10T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:abb6f7b423b4826833f568dbb119c408210cee72c34b516e3d65537dfc586ce2","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:30:17.951658Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05087/citation-record","integrity":"/paper/2506.05087/integrity","json":"/paper/2506.05087/citation-record.json","paper":"/paper/2506.05087"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.800182Z","title":"Subjective and objective measures of streetscape perceptions: Relationships with property value in Shanghai[J]","venue":null,"work_id":"8bb41087-4c03-4a24-b598-844e96b2fc5a","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.591759Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:5249af3ded0a3f7fd3df648ef2b5cfbc0b5435674739d08be9f92a402e6e808b","observation_id":"8f23cc93-8ecd-4cac-905a-0bc2ce7a1f7f","resolution":{"observed_at":"2026-08-07T10:30:20.885116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.619550Z","title":"Research on Urban Street Spatial Quality Based on Street View Image Segmentation[J]","venue":null,"work_id":"64aacd54-7672-4d3a-8577-8fae956222ce","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.606438Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:e4f48c9c4511e7f6c4def163ea9bfdd2df6bd04c64c7fdae31cb83e80d39c453","observation_id":"0ffefe2a-e24b-4590-be25-1a69b7e87f27","resolution":{"observed_at":"2026-08-07T10:30:20.673209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.434075Z","title":"Evaluation of Pedestrian-Perceived Comfort on Urban Streets Using Multi-Source Data: A Case Study in Nanjing, China[J]","venue":null,"work_id":"457c6bf0-d508-434f-9cd8-3bba1331c08c","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.613521Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:500a441767f73782b0165e87203c2a5cc3ec5e29bbcba956c486ec1ad32df9d9","observation_id":"586153b6-5ed8-4626-b701-c4566c96f455","resolution":{"observed_at":"2026-08-07T10:30:20.516256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.271398Z","title":"Measuring residents’ perceptions of city streets to inform better street planning through deep learning and space syntax[J]","venue":null,"work_id":"a302d554-5fbe-4d7d-aba9-550bb41d82a3","year":2022},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.621639Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:fc339298d06f3274dccd1dd64c9bfb4ca3d9b000fc9ce044fe87d76de53837e7","observation_id":"a0fc1fec-de7f-4e47-81f6-97a5cd090ac7","resolution":{"observed_at":"2026-08-07T10:30:20.331392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:17.628038Z","title":"Built environment, urban vitality and social cohesion: Do vibrant neighborhoods foster strong communities?[J]","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.628038Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:a56230adf6cc73c19285d6064feef056e48a045e91f57a34845b489c1564669e","observation_id":"211023d8-f9b6-49f8-bbfe-b7af71d06848","resolution":{"observed_at":"2026-08-07T10:30:17.628038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00610","last_updated":"2025-03-01T20:34:30Z","snapshot_observed_at":"2026-08-07T17:36:55.116584Z","submitted_at":"2025-03-01T20:34:30Z","title":"Urban Safety Perception Through the Lens of Large Multimodal Models: A Persona-based Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00610","snapshot_observed_at":"2026-08-07T10:30:17.642699Z","title":"Urban Safety Perception Through the Lens of Large Multimodal Models: A Persona-based Approach[J]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.642699Z"},"links":{"cited_paper":"/paper/2503.00610","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:e9d29bd3ec4853eeb1f5b0581f3014386028948c4cfb4d34100026bda8c8a23d","observation_id":"7add6a18-48e9-425d-95e7-4c8f844836bc","resolution":{"observed_at":"2026-08-07T10:30:17.642699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:20.072357Z","title":"Streetscape Analysis with Generative AI (SAGAI): Vision-Language Assessment and Mapping of Urban Scenes[J]","venue":null,"work_id":"5565f323-d3a1-42b8-8ab1-7e6d8cf25635","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.654296Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:9c3e39497a3becbb84611f7a60fc27ef3c6b8bd795be45af0ee86de94ce1335e","observation_id":"e94093e7-28ea-4ce9-bb39-4fd9b508f78d","resolution":{"observed_at":"2026-08-07T10:30:20.159918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.883318Z","title":"Quality of public space and sustainable development goals: analysis of nine urban projects in Spanish cities[J]","venue":null,"work_id":"1206449d-58dc-4af5-b15e-82fa13ac0c4a","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.665433Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:1db0e99737127d2d4d7a0b060b516be85780a621c39be5b119d1a7279e598f39","observation_id":"1c318adb-ff10-4628-b33a-cd2f7a0a1b21","resolution":{"observed_at":"2026-08-07T10:30:19.985491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:17.674570Z","title":"Assessing street-level urban greenery using Google Street View and a modified green view index[J]","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.674570Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:7c05e0c601d1f0e345417725b3cfa627296770eb768f9ee8e1609f9b588a959e","observation_id":"cc7feeb7-2fc1-4395-b597-fce92e40098b","resolution":{"observed_at":"2026-08-07T10:30:17.674570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.643142Z","title":"Streetscore-predicting the perceived safety of one million streetscapes[C]//Proceedings of the IEEE conference on computer vision and pattern recognition workshops","venue":null,"work_id":"5eb194ea-c5e2-44ac-b5c2-6669681c1dd2","year":2014},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.683794Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:74c2a1509fc891439bd6e97ff52d7f80aaf41d7ee1c796cdbbd2268c46af8ca5","observation_id":"89a5e99c-a502-4e33-85c8-024a79a24de7","resolution":{"observed_at":"2026-08-07T10:30:19.732083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.238591Z","title":"The digital life of walkable streets[C]//Proceedings of the 24th international conference on World Wide Web","venue":null,"work_id":"ed833ac0-a1bc-4c8d-ad09-eb0b14a5f6d7","year":2015},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.696835Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:0412ee30393ca9c8e892305bae69b52903c874e670760f9f208dc28a011b5e19","observation_id":"0b2af42d-0755-4c14-b3d7-8c261bbd95b2","resolution":{"observed_at":"2026-08-07T10:30:19.317537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.935793Z","title":"Sustainability, Creativity, and Livability in Great East Asian Megacities: Insights from Twenty-First Century Tokyo, Seoul, and Chinese Creative Clusters[J]","venue":null,"work_id":"d514709b-d955-477c-a76b-da3e0079f130","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.708774Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:c39ed6b7d50cebac8d2bc2698060e468458398722e41318ade180fc622338ef0","observation_id":"6012157b-d1f0-47b9-bab0-0c051665a7cd","resolution":{"observed_at":"2026-08-07T10:30:18.983586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.903332Z","title":"Gender, fear and the night-time city[M]//Fair Shared Cities","venue":null,"work_id":"94576bc9-b533-49f3-9458-f687a6b89123","year":2016},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.714316Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:34ab52f2a36e5125058c4d5f01d899fb1e0812d7c5946132b95f824e5e2ed161","observation_id":"16cea47e-95e8-4d6b-b1dc-8f934deff5b2","resolution":{"observed_at":"2026-08-07T10:30:18.916221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.835414Z","title":"The shortest path to happiness: Recommending beautiful, quiet, and happy routes in the city[C]//Proceedings of the 25th ACM conference on Hypertext and social media","venue":null,"work_id":"1ee3edc4-8ee9-4325-aae4-55603bfd1424","year":2014},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.727414Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:a15632055cc2ae4d5dfc9c6d5744581fc8d8edeed87fd3aa1d945892d0837b94","observation_id":"482cccc9-b68a-41c2-8dc5-d33ba7292777","resolution":{"observed_at":"2026-08-07T10:30:18.846947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.070167Z","title":null,"venue":null,"work_id":"695be345-3ba6-4b3e-8c43-78466ec5e075","year":2016},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.732939Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:d9b7733b017a4db4fbebe96194d731b921967e0ede8918100c7f249b67dfa39f","observation_id":"3a38a8de-cca4-4713-8698-6436e7e67758","resolution":{"observed_at":"2026-08-07T10:30:19.145096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.798957Z","title":"The city and the car[J]","venue":null,"work_id":"59771356-95a8-450b-80eb-41d7e4cefaca","year":2000},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.740838Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:545d1b34510dd050d9511de825e72758976d5792c0e569f98287653ca098cead","observation_id":"6772f86d-5aac-4784-921a-4f30ec87b752","resolution":{"observed_at":"2026-08-07T10:30:18.815761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:19.432077Z","title":"Assessing the level of walkability for women using GIS and location-based open data: The case of new york city[J]","venue":null,"work_id":"a98b3cf8-9864-4f32-9648-f2161226050b","year":2021},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.748609Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:a24ee4b93d05080ce91abb298b56ffa5285114f3f7879859931cf3aad107b47b","observation_id":"22d08d9e-4f10-41d3-baa9-9f3718778a17","resolution":{"observed_at":"2026-08-07T10:30:19.518768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.747528Z","title":"How to study public life[M]","venue":null,"work_id":"0a39b4f1-bf8d-40e1-9321-873717b54abc","year":2013},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.758559Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:bbf1544076c38b5aba6b503eb19b548b155146eb301bfee290c6da066445b6b5","observation_id":"e95bd789-34f1-4a6f-ac72-acb2f9d18d12","resolution":{"observed_at":"2026-08-07T10:30:18.762615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.715346Z","title":"Effects of skeletal streetscape design on perceived safety[J]","venue":null,"work_id":"13a1af80-e4f0-4941-b6eb-c7833701eb2b","year":2015},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.765476Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:188ff55ac37d38b45627eb51f93ccdfdef30ae556f396ee5d02a544b78871117","observation_id":"1cc5d86a-7ac8-4606-a3a5-3631848019f9","resolution":{"observed_at":"2026-08-07T10:30:18.724268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.686902Z","title":"Dynamic Urban Imagery and Emotional Perception in Shanghai's North Bund: A Deep Learning Approach[J]","venue":null,"work_id":"82fecf02-d25c-46c3-aa52-a6e90759ca63","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.774633Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:1e29ca1b01c37c951e482afb796edb520c70387310e726f11440ab81030be16c","observation_id":"93ce5d3a-606e-4c6d-91a7-57eb914e986b","resolution":{"observed_at":"2026-08-07T10:30:18.694829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.659086Z","title":"Exploring the coherence and divergence between the objective and subjective measurement of streetscape perceptions at the neighborhood level: A case study in Shanghai[J]","venue":null,"work_id":"56ed9799-8f6a-4fcb-a2c9-3264c8abcd28","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.784171Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:e6bc6be0638a8f70928523f3481f678bc1bf7d117cf9dd64da66bc61f3b51134","observation_id":"c06902ed-5125-43ba-b50c-97ffb3e85222","resolution":{"observed_at":"2026-08-07T10:30:18.668311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.867383Z","title":"Standardized green view index and quantification of different metrics of urban green vegetation[J]","venue":null,"work_id":"c6fb1674-474a-44ba-8866-e585f72acab0","year":2020},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.791064Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:5db1e7038d5e5d6cf01077f731dad273ffaf97cb4e50416795443651b80f9288","observation_id":"cd5be308-a7bd-480b-b99f-7d5f95b4f895","resolution":{"observed_at":"2026-08-07T10:30:18.880420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.631454Z","title":"Urban greenery and mental wellbeing in adults: Cross-sectional mediation analyses on multiple pathways across different greenery measures[J]","venue":null,"work_id":"4c807b0a-9e39-464f-b262-503979290444","year":2019},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.796683Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:e6fa571c73ef6160836edbec9ba29dc7867f1ec1903bec6859b7dab8f6b11f58","observation_id":"7e7164dd-67d1-4f5c-abdc-4ee292dcbaa7","resolution":{"observed_at":"2026-08-07T10:30:18.640872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.602036Z","title":"Determinants and effects of perceived walkability: a literature review, conceptual model and research agenda[J]","venue":null,"work_id":"481aeebe-de66-4ab2-8393-7159675e7767","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.802649Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:fcf19450f28c7e1bf0f966d30c36c3b2504dc95cdbfab5e1af130640c79db45d","observation_id":"05bfdda7-0ffb-46cb-af05-7eadc9cfd989","resolution":{"observed_at":"2026-08-07T10:30:18.608087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.578409Z","title":"How to Construct an Urban Color System? Taking the Historic Center of Macau as an Example[J]","venue":null,"work_id":"a51b2146-6f95-4087-800e-62cd19905684","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.812224Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:20f7e6a4575dd5e3b68e922c50d16d65a92d3f187007157f8bf11d92585aac00","observation_id":"98f647ac-a69b-4e6c-8b0f-3a9735bab58d","resolution":{"observed_at":"2026-08-07T10:30:18.585287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.551731Z","title":"Learning transferable visual models from natural language supervision[C]//International conference on machine learning","venue":null,"work_id":"449af835-7987-4bab-ba6c-761008286ce5","year":2021},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.820388Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:b4edd8304d174268aba30b20e7e054eb8c74abf4f3166b625223ce8f541ad950","observation_id":"f76a20af-fa76-4de3-94c9-96fcb3c58350","resolution":{"observed_at":"2026-08-07T10:30:18.562157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.518026Z","title":"Urbanclip: Learning text-enhanced urban region profiling with contrastive language-image pretraining from the web[C]//Proceedings of the ACM Web Conference 2024","venue":null,"work_id":"137a61a7-5a37-4cd3-8ed9-2c280068db9f","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.827102Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:9d96eaf4c38b5d296307b626c783577cc9cbe456c30eb680f0d02e4ce3183918","observation_id":"f33507ed-bade-407b-9aa7-9b4c3e73f524","resolution":{"observed_at":"2026-08-07T10:30:18.526974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.490912Z","title":"Uncertainties of human perception in visual image interpretation in complex urban environments[J]","venue":null,"work_id":"c90d7bcd-68fe-451e-84ba-e2844b4bc08b","year":2020},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.833960Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:ddbec024b773dd1d9c51a42947cc38ab0649f09d42dca1a7e76e651be3848e68","observation_id":"d99a1b4f-6511-47bf-9241-496aa5f436db","resolution":{"observed_at":"2026-08-07T10:30:18.502474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.455686Z","title":"Exploring the impact of urban built environment on public emotions based on social media data: a case study of Wuhan[J]","venue":null,"work_id":"696cee46-947d-4a85-a31e-751e18d7a973","year":2021},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.844566Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:cdee232948477a934033eb3ca4f61b965bbe583b345f903c64dcb10811430357","observation_id":"e3f4eecc-2724-4e03-a75d-9b7d8263f36a","resolution":{"observed_at":"2026-08-07T10:30:18.466832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.429387Z","title":"Quantitative land price analysis via computer vision from street view images[J]","venue":null,"work_id":"8b2e1324-349e-48b6-96a5-3d491ec78922","year":2023},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.856908Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:cd70c2ec162298788115069c596a9408a6290c94749a1ada089872943a2ba07b","observation_id":"1350cd71-0a83-4f15-aa30-b182e943583f","resolution":{"observed_at":"2026-08-07T10:30:18.435972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.396270Z","title":"Evaluating the subjective perceptions of streetscapes using street-view images[J]","venue":null,"work_id":"7fc09b1f-62fd-47fa-848d-f99da862d946","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.869916Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:f07e155b445511aded4bd99471087f719f7177a014f9bdd737d9e01af8e80d20","observation_id":"2a7599a0-54b9-4e13-8691-22a47d076222","resolution":{"observed_at":"2026-08-07T10:30:18.404604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.350483Z","title":"Timechat: A time-sensitive multimodal large language model for long video understanding[C]//Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"8fb6e7d7-0803-4d89-a58f-24368ef0aa44","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.877854Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:a2e03c380fcf9e771b693e6de56d1eafa52550157ed09a80b5528376f6439f2e","observation_id":"0f6ee772-4304-4c58-b557-32d84c6c0b5c","resolution":{"observed_at":"2026-08-07T10:30:18.364618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14268","last_updated":"2024-06-29T10:32:58Z","snapshot_observed_at":"2026-07-06T18:49:02.371640Z","submitted_at":"2024-06-29T10:32:58Z","title":"Urban Visual Appeal According to ChatGPT: Contrasting AI and Human Insights","version":1},"cited_work":{"arxiv_id":"2407.14268","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14268","snapshot_observed_at":"2026-08-07T10:30:18.160956Z","title":"Urban Visual Appeal According to ChatGPT: Contrasting AI and Human Insights","venue":"cs.HC","work_id":"bfbceb27-14c8-4753-b4f7-27a3203f879e","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.883889Z"},"links":{"cited_paper":"/paper/2407.14268","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:3eea06a51a897b280c5ed7b9de175bc5c1888af7ccaa1eea53e46a6b8b71df4a","observation_id":"2b006c46-cd77-42a2-8bdd-06589dae9f08","resolution":{"observed_at":"2026-08-07T10:30:18.169482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.320305Z","title":"Multimodal Spatio-Temporal Data Visualization Technologies for Contemporary Urban Landscape Architecture: A Review and Prospect in the Context of Smart Cities[J]","venue":null,"work_id":"72ca4a19-137b-4fb8-9b14-2d2711871193","year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.891397Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:c441ad69d5db14d4507a3ac2e18ed8ca042d543e20c1ad161750ff7806850377","observation_id":"c6cbe191-bb83-4a9f-9a48-7c6c95a988ce","resolution":{"observed_at":"2026-08-07T10:30:18.328326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14476","last_updated":"2024-11-19T05:15:19Z","snapshot_observed_at":"2026-08-09T07:15:50.891898Z","submitted_at":"2024-11-19T05:15:19Z","title":"StreetviewLLM: Extracting Geographic Information Using a Chain-of-Thought Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14476","snapshot_observed_at":"2026-08-07T10:30:17.896560Z","title":"StreetviewLLM: Extracting Geographic Information Using a Chain-of-Thought Multimodal Large Language Model[J]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.896560Z"},"links":{"cited_paper":"/paper/2411.14476","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:ec2dd34164db4aa8511a5cc8de940e15664765180232deb2809fa3e61e333215","observation_id":"08abf6c2-e97b-408c-9e04-15abe509be24","resolution":{"observed_at":"2026-08-07T10:30:17.896560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16326","last_updated":"2025-03-20T16:45:48Z","snapshot_observed_at":"2026-08-07T16:48:37.625471Z","submitted_at":"2025-03-20T16:45:48Z","title":"OmniGeo: Towards a Multimodal Large Language Models for Geospatial Artificial Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16326","snapshot_observed_at":"2026-08-07T10:30:17.905841Z","title":"Omnigeo: Towards a multimodal large language models for geospatial artificial intelligence[J]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.905841Z"},"links":{"cited_paper":"/paper/2503.16326","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:897c6860377c5ed31f362665472ebb1243d2cb0801f7d418840a84545ea95824","observation_id":"d3bf2d5d-84c2-4123-879f-89b4156e35f8","resolution":{"observed_at":"2026-08-07T10:30:17.905841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08810","last_updated":"2024-10-14T07:43:05Z","snapshot_observed_at":"2026-07-06T19:31:49.052556Z","submitted_at":"2024-10-11T13:47:53Z","title":"LIME-Eval: Rethinking Low-light Image Enhancement Evaluation via Object Detection","version":2},"cited_work":{"arxiv_id":"2410.08810","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.08810","snapshot_observed_at":"2026-08-07T10:30:18.064105Z","title":"LIME-Eval: Rethinking Low-light Image Enhancement Evaluation via Object Detection","venue":"cs.CV","work_id":"40bc72ee-3caf-4d8c-902a-b155ca8ea1f1","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.914004Z"},"links":{"cited_paper":"/paper/2410.08810","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:d9f90a8fe7cab553f8a58d23ae3ad6afcdaa6b219fabe88af094b5d61a8596a0","observation_id":"0ccf12fb-b0dc-4fb6-8405-adf9b685ba2d","resolution":{"observed_at":"2026-08-07T10:30:18.070654Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.280366Z","title":"Urbangpt: Spatio-temporal large language models[C]//Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining","venue":null,"work_id":"881db347-9684-4eb7-bbd7-b2dc07609d4e","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.923358Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:a3cf04de04a023b4d9f8f77d19688cb2b10085a1d84785bbb1fa86fab335b0d3","observation_id":"5dce882b-1cee-4eeb-9f82-274ff2d7c3df","resolution":{"observed_at":"2026-08-07T10:30:18.290346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.249365Z","title":"UrbanMLLM: Joint Learning of Cross-view Imagery for Urban Understanding[J]","venue":null,"work_id":"9b90d243-d3d2-4386-a87f-59bfb4b3adc2","year":null},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.930567Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:664159acac61e0cb4191732e07c438319bc37e8489bfd0929ce13b65e5abe3b7","observation_id":"bffa4a61-5ec0-4b87-8013-398f593de7c6","resolution":{"observed_at":"2026-08-07T10:30:18.263594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19719","last_updated":"2025-06-02T05:10:45Z","snapshot_observed_at":"2026-08-09T01:53:38.613547Z","submitted_at":"2024-07-29T06:03:13Z","title":"Urban Safety Perception Assessments via Integrating Multimodal Large Language Models with Street View Images","version":3},"cited_work":{"arxiv_id":"2407.19719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.19719","snapshot_observed_at":"2026-08-07T10:30:18.020857Z","title":"Urban Safety Perception Assessments via Integrating Multimodal Large Language Models with Street View Images","venue":"cs.CV","work_id":"e39c625c-dac8-4234-a958-1caa1f9df8fe","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.943253Z"},"links":{"cited_paper":"/paper/2407.19719","citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:10a0cb8ffa9e7c3a381b3fb858e1b1d2d73952c67539c05ff84415eb0f33a48c","observation_id":"1e0ab817-33c6-45e4-b062-30f963ffebae","resolution":{"observed_at":"2026-08-07T10:30:18.032377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:18.226212Z","title":"Situation awareness in ai-based technologies and multimodal systems: Architectures, challenges and applications[J]","venue":null,"work_id":"0a5f1ed6-3cba-4aa4-aa11-78659fbd7772","year":2024},"citing_paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:17.951658Z"},"links":{"citing_paper":"/paper/2506.05087"},"observation_digest":"sha256:f938a5389b37a645386ab834ba1078280d6751b4c6cdfeea12008905f0294406","observation_id":"21630693-04c5-4b35-9e32-0efc999bf7d1","resolution":{"observed_at":"2026-08-07T10:30:18.233234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05087","last_updated":"2025-06-05T14:34:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T07:16:30.097592Z","submitted_at":"2025-06-05T14:34:04Z","title":"Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":3,"verified_fuzzy":32},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2506.05087."}