{"as_of":"2026-08-18T22:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b28e3d1fdbbbb47b5e3804e233c0bc175751f1e30c7a6f9c4cf22bd09284d6d2","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:09:57.752216Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T07:24:06.863653Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T08:53:16.571474Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"cited_work":{"arxiv_id":"2508.20410","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20410","snapshot_observed_at":"2026-06-29T08:53:16.571474Z","title":null,"venue":null,"work_id":"6eb4f8c3-5692-4c39-9020-5110a6cfb70c","year":2025},"citing_paper":{"arxiv_id":"2605.30000","last_updated":"2026-05-31T12:00:02Z","snapshot_observed_at":"2026-08-02T18:55:27.003152Z","submitted_at":"2026-05-28T14:30:33Z","title":"Cookie-Bench: Continuous On-screen Key Interaction Evaluation for Web Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T07:24:06.863653Z"},"links":{"cited_paper":"/paper/2508.20410","citing_paper":"/paper/2605.30000"},"observation_digest":"sha256:ba795e46c567cbc7480e366451c34509fe8b25f42ee47f096432ed532e6d7c1a","observation_id":"7f67039e-6fbf-438a-ab82-ba6c45131e25","resolution":{"observed_at":"2026-06-29T08:53:16.572734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.20410/citation-record","integrity":"/paper/2508.20410/integrity","json":"/paper/2508.20410/citation-record.json","paper":"/paper/2508.20410"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.214481Z","title":null,"venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.214481Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:d388fc7d9f455ab8558bd9311e5071e0ef00cd73b5a7a46f3f69747347263e90","observation_id":"65aab1c0-7db7-41aa-abff-39dde2965523","resolution":{"observed_at":"2026-08-05T15:09:57.214481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:10:00.129069Z","title":null,"venue":null,"work_id":"4b640668-dddd-41a4-b874-e1233525006f","year":1996},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.228327Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:192746f81447d2c9e5b43b2bc5db2c5e99b48e80960a2967a7a648408a2e6188","observation_id":"82ed7fb3-3e55-4177-940b-3c57279370b7","resolution":{"observed_at":"2026-08-05T15:10:00.136771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.249680Z","title":"Bradley and Milton E","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.249680Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:ff87b98b3041d68302da6622f301485d958ebd25b2b404f2d4d74198c33c7e71","observation_id":"b0ccbc2a-037a-4b79-b510-5d9d5366ec60","resolution":{"observed_at":"2026-08-05T15:09:57.249680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T15:09:57.259941Z","title":"Evaluating large language models trained on code, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.259941Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:922db934416ca88566385460e67e5ac5df19a0fd58cb69cf90bf5b750ea32243","observation_id":"1631b0f7-7cd7-4890-bcdb-45ed640fd8b3","resolution":{"observed_at":"2026-08-05T15:09:57.259941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04132","last_updated":"2024-03-07T01:22:38Z","snapshot_observed_at":"2026-08-02T17:55:33.750637Z","submitted_at":"2024-03-07T01:22:38Z","title":"Chatbot Arena: An Open Platform for Evaluating LLMs by Human Preference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04132","snapshot_observed_at":"2026-08-05T15:09:57.271533Z","title":"Chiang, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.271533Z"},"links":{"cited_paper":"/paper/2403.04132","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:30c5a877c060980da8ca95b77b26be6b9053800db9682927f3d9559789a6592c","observation_id":"815ef57a-394b-4e6a-a9cb-8930cc89e648","resolution":{"observed_at":"2026-08-05T15:09:57.271533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:10:00.095054Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":"8c7b55b7-d4c8-43a6-b682-ac664947608f","year":2017},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.282278Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:6d9ba89cccd8d4dc13db301706d3bb871ee5add74334009f6df15113d1cc976d","observation_id":"afdfb030-efd2-4bea-9827-9445d805f67d","resolution":{"observed_at":"2026-08-05T15:10:00.103926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T15:09:57.290745Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.290745Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:31a18b6ab86118e1d05bf9fbbe747a63ccde2bcc2191e763000382a5deb4684f","observation_id":"5164c8bb-d624-499e-90b9-59288ff6734e","resolution":{"observed_at":"2026-08-05T15:09:57.290745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ijhcs.2018.11.006","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Webthetics: Quantifying webpage aesthetics with deep learning","venue":"International Journal of Human-Computer Studies","work_id":"273c60b5-64fb-4b20-b85b-671c7c4d9f4b","year":2019},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.299263Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:924aa51d2f228e15be4ab3839447d5673a478d53bea91065aab6cb771edf4c21","observation_id":"70645d0a-507c-4d93-827f-0c62fb73eff2","resolution":{"observed_at":"2026-08-05T15:09:58.246249Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-05T15:09:57.307467Z","title":"Hashimoto","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.307467Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:9066216ccf562ccec471fbfae8a208368aba5c366f652d581845151069df66b0","observation_id":"8052a84d-fe4f-492b-b80a-39e2a558cc6b","resolution":{"observed_at":"2026-08-05T15:09:57.307467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.28945/4016","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"How content volume on landing pages influences consumer behavior: Empirical evidence","venue":"Informing Science and IT Education Conference","work_id":"932fd3d9-9383-4b65-9c4b-5a88b98841b4","year":2018},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.325846Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:3b6730b15bad667e1be73da802e64de041eeb2d53ba96feaab7ed119640e55b6","observation_id":"7e0ab56e-42f0-47ec-b5e5-71a656ad01dc","resolution":{"observed_at":"2026-08-05T15:09:58.198420Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5024.36503","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:58.989034Z","title":null,"venue":null,"work_id":"3c369483-4a09-4b9a-b456-7a79eb9f0659","year":2001},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.331145Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:aeb635844f5c74922582f76628c01b8257fbf68234b7603f9c3d972f19b3fbb3","observation_id":"1951a0b7-5bd7-4954-8286-58e544bf0fa6","resolution":{"observed_at":"2026-08-05T15:09:59.005222Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:10:00.068227Z","title":"WebCode2M : A real-world dataset for code generation from webpage designs","venue":null,"work_id":"c63c5817-b01c-4ee3-84c4-e9b505e23973","year":2025},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.344168Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:251181f8461b3f19f8a40ddcafbb1465391ad99be4c0e50e4ddc4e220a12ffe4","observation_id":"bef0b77a-d46b-4d4b-9eea-904ec3679ed4","resolution":{"observed_at":"2026-08-05T15:10:00.076131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T15:09:57.353378Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.353378Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:68a3c26c224d7db66692730bb8efeb2769e3cdd6213eb6736b4213d07d10366b","observation_id":"d5b66df0-df1a-4725-8add-002146646b19","resolution":{"observed_at":"2026-08-05T15:09:57.353378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:10:00.024886Z","title":"TrueSkill : A Bayesian skill rating system","venue":null,"work_id":"ea49ab90-0be9-4413-89d9-8c7c6f670e1b","year":2006},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.362611Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:1959b4bffa20ca5c938a29540efb75d9b424ed811268d492f2cd0758b27452f1","observation_id":"10c698a1-371a-4203-831b-a0d9b6bb1e55","resolution":{"observed_at":"2026-08-05T15:10:00.037332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.369473Z","title":"CLIPScore : A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.369473Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:37827f57fc71591cf5728f450ac66c5e12aace8d4daa83f1cc548119f8356703","observation_id":"805bf1fd-3454-406d-82a7-831e5ee645b0","resolution":{"observed_at":"2026-08-05T15:09:57.369473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08500","last_updated":"2018-01-12T14:05:44Z","snapshot_observed_at":"2026-08-14T20:51:33.836666Z","submitted_at":"2017-06-26T17:45:23Z","title":"GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08500","snapshot_observed_at":"2026-08-05T15:09:57.384528Z","title":"GANs trained by a two time-scale update rule converge to a local Nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.384528Z"},"links":{"cited_paper":"/paper/1706.08500","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:57daef5ae8d9079085a2f55b5c09298e5eda99ab1ae70f78c3c07a62f2269b20","observation_id":"d096ce4d-9172-4431-ad5a-b9ce72a23dc5","resolution":{"observed_at":"2026-08-05T15:09:57.384528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1108/intr-09-2016-0271","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Jankowski, J","venue":"Internet Research","work_id":"e6906478-5c9a-4e85-8315-36bf78f3ae67","year":2019},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.399939Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:f302e2ef63a0f0b50c7bd82bcfc7bfd2e2663821a1d4b0b1ca0bfd9441e57cb8","observation_id":"b33c70c1-dab6-4d35-ad5d-cc14f7848e0a","resolution":{"observed_at":"2026-08-05T15:09:58.131424Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.990132Z","title":"Jayasumana, X","venue":null,"work_id":"920ff180-68a8-406f-8d8a-957c58272220","year":2024},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.418581Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:cd2a68a44cf58f3c6719e2f74395658e01d7ce43fa597b115c88bdb06fb7174f","observation_id":"1af8fce2-5fe6-41c9-8579-99bde460859d","resolution":{"observed_at":"2026-08-05T15:10:00.007654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.970353Z","title":"Kirstain, A","venue":null,"work_id":"1bd1a17d-e46a-4399-a88b-1ea7cc17663b","year":2023},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.428490Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:29e48cc851a553bd832d28fc7d0fdc2fbcd1c8a1311edc6a1edc47ba9e719877","observation_id":"d6959b45-c4ac-4162-91f4-e7a3ecb6b2bf","resolution":{"observed_at":"2026-08-05T15:09:59.976421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ijhcs.2003.09.002","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Assessing dimensions of perceived visual aesthetics of web sites","venue":"International Journal of Human-Computer Studies","work_id":"a266b7db-df30-4106-95e6-43cd42f20057","year":2004},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.435107Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:4d61316162160638260e9bd13bcdb8278045757c80630120e56a543859017c23","observation_id":"11f51ac6-fab9-401d-9885-932ddb207ef5","resolution":{"observed_at":"2026-08-05T15:09:58.093488Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04287","last_updated":"2023-11-07T19:00:56Z","snapshot_observed_at":"2026-08-16T14:45:10.233592Z","submitted_at":"2023-11-07T19:00:56Z","title":"Holistic Evaluation of Text-To-Image Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04287","snapshot_observed_at":"2026-08-05T15:09:57.445683Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.445683Z"},"links":{"cited_paper":"/paper/2311.04287","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:28544d80c681c2b75e7250d7c068ac6da9628ba57cfb1ff5cfaca110608d46e1","observation_id":"4b46df08-7fed-4de0-8419-9a51b9f944c7","resolution":{"observed_at":"2026-08-05T15:09:57.445683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.454500Z","title":"Lu, Zhe Lin, Hailin Jin, Jianchao Yang, and James Z","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.454500Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:8699374c73adc7b3ae02caa08b930b92a2f1422639107a2e952eb223a37a97b1","observation_id":"d375a1df-5c6f-4bfc-b978-cfe80cc22b82","resolution":{"observed_at":"2026-08-05T15:09:57.454500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.937770Z","title":"WebGen-Bench : Evaluating LLMs on generating interactive and functional websites from scratch, 2025","venue":null,"work_id":"ede62d39-7032-495a-be09-a92fffd37568","year":2025},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.473086Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:28e6b9748cb6d13c82daa0d06705f3a3af8ad7589d7df54a8666fed78a0b7c2b","observation_id":"cf20d954-4553-47c3-be97-a12dac46b1e1","resolution":{"observed_at":"2026-08-05T15:09:59.956095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.571240Z","title":"FinanceQA : A benchmark for evaluating financial analysis capabilities of large language models, 2025","venue":null,"work_id":"0c07fb32-50a2-41bf-a328-e3af1a92619e","year":2025},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.483190Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:eb18de6cc1c053ed5bba9bafa730e7f7616ecea55547bdbc19bae7c4bd1a2656","observation_id":"ef14ae84-7beb-4282-ba38-330ec87c57ff","resolution":{"observed_at":"2026-08-05T15:09:59.581827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ijhcs.2010.05.006","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Moshagen and M","venue":"International Journal of Human-Computer Studies","work_id":"1640948b-1427-4a32-8aca-bb2a6f23863d","year":2010},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.493486Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:1d7a0afd2bfb02b762143d72dd30b5c9c1047b81125cc914464cd2a7690368cd","observation_id":"1aa2f16e-85b4-4548-b80f-cd5788622e03","resolution":{"observed_at":"2026-08-05T15:09:58.052019Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.1240466","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Science","work_id":"d806334d-b94e-433e-9f5e-573a2d345fde","year":2013},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.498765Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:43824172a964e4fc373e66d7718d698505616a59e1b115ba7a42d87b83896d1a","observation_id":"5a1b4542-2893-402d-9ec4-9bc09ed90dfe","resolution":{"observed_at":"2026-08-05T15:09:58.001466Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0020-0255(02)00404-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Information Sciences","work_id":"37c8f438-032f-4b37-b609-5f0e7bbed1f8","year":2003},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.508823Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:23f009cf008aef9f3ed752941601ed86442647637b24180e5c9f9ea831561b0f","observation_id":"a1a29273-0c60-4209-9cab-56af46a901c0","resolution":{"observed_at":"2026-08-05T15:09:57.968857Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.521078Z","title":"Color compatibility from large datasets","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.521078Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:d2f1d7f475cf7396af57468848c5933631b63310318898f8b6c90ac89a1e9b15","observation_id":"7a3658b6-317a-43be-be2b-509af2ea6a0a","resolution":{"observed_at":"2026-08-05T15:09:57.521078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10798-011-9189-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Comparative judgement for assessment","venue":"International Journal of Technology and Design Education","work_id":"24cc0cec-9ceb-4227-95b3-76950a1b7b26","year":2012},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.544692Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:373cf01491a02f54ba0d4b0bc46d9c1acfb7f6a24d736d7ea978cf69d2eb668e","observation_id":"3930f5c6-49c0-4fe0-8bda-23a31511888b","resolution":{"observed_at":"2026-08-05T15:09:57.944022Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-05T15:09:57.551803Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.551803Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:74ad78ac8255b36ca91b6c4080e5ddc19daccb939a5426d345ede27d43964ef0","observation_id":"4a059356-abf0-4b3f-8645-fb68b21e424d","resolution":{"observed_at":"2026-08-05T15:09:57.551803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.560815Z","title":null,"venue":null,"work_id":null,"year":2049},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.560815Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:aec6929878cb41ac2f675430aa9f237f7baca31aeeb2741fc0e511e8fd87dce0","observation_id":"780ed652-e905-4c07-afd6-8047d7423360","resolution":{"observed_at":"2026-08-05T15:09:57.560815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ipm.2007.02.003","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Robins and J","venue":"Information Processing & Management","work_id":"98f2ffa0-0ff8-4cb3-96f2-2feeb4de2018","year":2008},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.567210Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:d23ccdb08ef496d1cbe048ccb43b7f06f1131f664486882e42e041910b9cf951","observation_id":"726bf2ae-d03a-4edd-a1fa-6f783aa1e233","resolution":{"observed_at":"2026-08-05T15:09:57.890926Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.511150Z","title":"Improved techniques for training GANs","venue":null,"work_id":"ba206283-55be-4c59-a711-149451283df5","year":2016},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.578034Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:25c369851ab7fdbb04b8b55f8df70f1cfb7a87af418c8505f19f477e31812dc8","observation_id":"b6e395de-eed0-4f80-bef3-404ac0bf52c9","resolution":{"observed_at":"2026-08-05T15:09:59.528856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.474388Z","title":"Design2code: Benchmarking multimodal code generation for automated front-end engineering","venue":null,"work_id":"c877c1e3-eff5-427e-a12d-435a980de0cf","year":2025},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.587542Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:409a3a5410118c38e5acc69c65ae0efe8af681bc5b4759b7c40be16ce52a93e5","observation_id":"00f33793-f036-4738-b5a9-500883cbaa17","resolution":{"observed_at":"2026-08-05T15:09:59.486372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-05T15:09:57.600054Z","title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models ( BIG -bench)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.600054Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:70c57a73c1d6d97707a7964f81e54dce181024a268ae3b9576e7754029178523","observation_id":"4bc571d7-7ab6-4154-810c-63e8604c644e","resolution":{"observed_at":"2026-08-05T15:09:57.600054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.616198Z","title":null,"venue":null,"work_id":null,"year":1927},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.616198Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:b342d1afdf157d26f3ef24e64004cf3ed0c19a447570c091e760e883e2880c9a","observation_id":"7974c531-9c2a-4cf1-8f4c-b6ab4c679265","resolution":{"observed_at":"2026-08-05T15:09:57.616198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.450417Z","title":null,"venue":null,"work_id":"4fd939a2-4bcb-4ae6-9109-94c02d8bd900","year":2018},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.632179Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:adb311849eb5027aa9267ed7946c7415a4eb82a5b3c1946a6e5b4814dcbf7cba","observation_id":"59b385df-0352-4354-93e7-a1711bde6633","resolution":{"observed_at":"2026-08-05T15:09:59.458898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.396058Z","title":"Whitehouse and A","venue":null,"work_id":"20c3b2ce-9423-4422-bd4e-2a8f53e85573","year":2012},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.660119Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:5f8296ec144d33901d95afb5d0eab591086c0f03e64f21f39091243713b9fbe0","observation_id":"9e84e18a-f110-41fd-9462-3f84d46f5535","resolution":{"observed_at":"2026-08-05T15:09:59.411804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.333168Z","title":"The best AI website builders in 2025","venue":null,"work_id":"3793f984-ed86-4bcb-94fc-bd9dbc2a3c97","year":2025},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.666058Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:0e12023d65114c874d74c503eb2ac56328dab46efe81a4338203b1e2d0b7ed86","observation_id":"33c07487-797b-403e-b788-78158d38fad2","resolution":{"observed_at":"2026-08-05T15:09:59.346581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.296091Z","title":null,"venue":null,"work_id":"2d836000-835f-439f-924a-13157b3c05b9","year":2025},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.676210Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:3c991ec05ee795ac0cd1b715d85df1338d322dd45995120e14e587f28598ce6e","observation_id":"4a486708-4a75-4fc0-b6ee-57bd492e3288","resolution":{"observed_at":"2026-08-05T15:09:59.308828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.259517Z","title":null,"venue":null,"work_id":"6d6b6d72-85aa-4799-bb3e-8757bdc700a4","year":2023},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.685514Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:e1d9671b1a9ed1d5d3ecea629bd7c92c21168770b4bc5722253215d2dc7f97ed","observation_id":"9787ea74-1043-441b-b32d-316a22f13fbc","resolution":{"observed_at":"2026-08-05T15:09:59.272758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.205916Z","title":"Xing, Xiaodan Liang, and Zhiqiang Shen","venue":null,"work_id":"13181be0-9680-403a-9c33-e022023a3478","year":2024},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.702743Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:e0ba10b790d83be6b54bc9ceac2c9b8f544dc68e02fb1c9d5c8acf9da4972442","observation_id":"0a914eb3-5578-49f3-9ac9-f97c4e4a3d6c","resolution":{"observed_at":"2026-08-05T15:09:59.218374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:57.714904Z","title":"HellaSwag : Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics (ACL), pages 4791--4800, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.714904Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:c7ea7d4edc27d50357eeb86a80aca008d55e9dc0bd76e5d01f3cc57f9b510ace","observation_id":"11547017-77de-474a-9487-e17c54314058","resolution":{"observed_at":"2026-08-05T15:09:57.714904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-05T15:09:57.731423Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.731423Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:e21ade0a5d1a52b8ac184dbdbab822e78e2ca2ba4e475c1b32163d06ebdf77c2","observation_id":"1ddf4ede-2689-4c44-aa82-7a89064a3b35","resolution":{"observed_at":"2026-08-05T15:09:57.731423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-05T15:09:57.740219Z","title":"AGIEval : A human-centric benchmark for evaluating foundation models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.740219Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:45bacf95eafcb5670e2f0d82d3f76da55ab6a953d22f23391359896a01efb9b8","observation_id":"060cab31-313c-40c3-9f4c-a3b8396c4f00","resolution":{"observed_at":"2026-08-05T15:09:57.740219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:09:59.179547Z","title":"Frontendbench: A benchmark for evaluating LLMs on front-end development via automatic evaluation, 2025","venue":null,"work_id":"cc917c27-95dd-4307-8297-2e21882fd675","year":2025},"citing_paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T15:09:57.752216Z"},"links":{"citing_paper":"/paper/2508.20410"},"observation_digest":"sha256:01df116518f59d17112d83736122bd54daf0f52bbdb53999cbae689b6b4352ea","observation_id":"cde96057-7635-47b3-8f39-15b200a6330d","resolution":{"observed_at":"2026-08-05T15:09:59.186704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.20410","last_updated":"2025-09-03T23:48:21Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T11:19:07.672290Z","submitted_at":"2025-08-28T04:20:00Z","title":"UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":8,"verified_fuzzy":13},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2508.20410."}