{"as_of":"2026-08-16T18:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9172fe25c75c396e8c9d5f02a0e016e85016ffa96d14a5d65929b76353d32e86","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:31:38.440967Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04750/citation-record","integrity":"/paper/2608.04750/integrity","json":"/paper/2608.04750/citation-record.json","paper":"/paper/2608.04750"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-14T03:45:52.225630Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T17:31:32.955187Z","title":"Hewett, Mojan Javaheripi, Piero Kauff- mann, James R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:32.955187Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:932162846d4085590217eeace8132b215aca8cc7a92b864c8f7a5bf5d0a6e7b8","observation_id":"3e3c451b-5434-4b37-8096-452e71d73f5d","resolution":{"observed_at":"2026-08-06T17:31:32.955187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09898","last_updated":"2023-06-02T04:01:00Z","snapshot_observed_at":"2026-08-16T16:07:29.830248Z","submitted_at":"2022-12-19T22:41:46Z","title":"MetaCLUE: Towards Comprehensive Visual Metaphors Research","version":3},"cited_work":{"arxiv_id":"2212.09898","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.09898","snapshot_observed_at":"2026-08-06T17:31:40.164942Z","title":"MetaCLUE: Towards Comprehensive Visual Metaphors Research","venue":"cs.CV","work_id":"6dbedcb8-55bc-4bb3-88d3-1046b96f6c76","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.070050Z"},"links":{"cited_paper":"/paper/2212.09898","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:bfd271d9c5a7cf5b767af18363656eeaea5ea571d3695d7df681f3deeb45a817","observation_id":"885cef89-86e2-42f8-b3b4-a66d9ef95fbb","resolution":{"observed_at":"2026-08-06T17:31:40.175533Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.586615Z","title":null,"venue":null,"work_id":"52b050a9-bee7-4082-92c0-f45e9c3306fa","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.227622Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:dfd689c2aaed48a06416d91ee2934a4e478e22de567e470247dc0d368ea0985d","observation_id":"fe3f5532-dde5-4872-849a-4de6087321d5","resolution":{"observed_at":"2026-08-06T17:31:40.593156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.566010Z","title":null,"venue":null,"work_id":"535516bf-93a1-42d2-be06-3718961f73c4","year":2006},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.311842Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:eaa778326fa7b60b8a165558b0beb03f661dbad9bf4a67f68df10365227874ea","observation_id":"8ccbb689-ad33-4681-883b-4e9c35d6e1a5","resolution":{"observed_at":"2026-08-06T17:31:40.572219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:33.390098Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.390098Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:b77099e6db88e7b4aad1de3705a8f73e92214f9d66365e078a0a791c10d61d94","observation_id":"566305ba-3db7-47dd-9fe0-b5aed6143e1a","resolution":{"observed_at":"2026-08-06T17:31:33.390098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:33.473819Z","title":"Bowman and George Dahl","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.473819Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:8945610d6cefd3f65186f1a199a3520dd8a8511ac33a1339b8b06be0d9856a78","observation_id":"ed99ce08-5b1f-4fa0-a167-15cc25a4bed6","resolution":{"observed_at":"2026-08-06T17:31:33.473819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:33.717544Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.717544Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:9afdc67cd66cd82eac0ac4be751ab76bde97996db6f82165e5a29492fa0f4c53","observation_id":"dc9ca7ea-08cd-449a-8463-0540a2515ddf","resolution":{"observed_at":"2026-08-06T17:31:33.717544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-06T17:31:33.800704Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.800704Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:cb06ea44617ed70d248144bd336113d819d0c2de6337bdddc1b882f35183460a","observation_id":"90289543-37f3-42d6-baa1-29919d9ce7c5","resolution":{"observed_at":"2026-08-06T17:31:33.800704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.404","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"beb84f6a-3906-4cad-855c-f90e3911e27a","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.916651Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:d1b250ad1f0b059456ffe0510ba362af066b746666d682aef4f278643f9b1442","observation_id":"fd2ed102-c9d2-44a5-ac19-5edc7091025f","resolution":{"observed_at":"2026-08-06T17:31:39.421049Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.016572Z","title":"DiStefano, John D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.016572Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:bdfd55526acd692b633ed51ac08e6c7809e7b1533d1d2f93639bbedaa46a688e","observation_id":"a49129b9-851b-4b71-a221-4c74246b0d59","resolution":{"observed_at":"2026-08-06T17:31:34.016572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-08-13T01:47:21.043519Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-06T17:31:34.100732Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.100732Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:bd35ec05d7ce9a227ea1126ccd727936efa363d8fae4ce6bdd28b3a0f5744f80","observation_id":"7432559b-1fe3-4016-92c6-a97c95438051","resolution":{"observed_at":"2026-08-06T17:31:34.100732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.182300Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.182300Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:8be747746b1e29f42d78ece762fba81aa7e8b239dedf1ac98cc8843de2487a7f","observation_id":"c6981fc7-4e3a-4b1d-9070-7dbba5e2df55","resolution":{"observed_at":"2026-08-06T17:31:34.182300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.264571Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.264571Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:bf217ab785a3bb88f461de212a5dd457371bbbba8f451473109ed0198ff61111","observation_id":"fad343eb-b91a-446a-b149-1da214e9cba6","resolution":{"observed_at":"2026-08-06T17:31:34.264571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11513","last_updated":"2023-10-17T18:20:03Z","snapshot_observed_at":"2026-08-16T14:51:16.293174Z","submitted_at":"2023-10-17T18:20:03Z","title":"GenEval: An Object-Focused Framework for Evaluating Text-to-Image Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11513","snapshot_observed_at":"2026-08-06T17:31:34.346158Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.346158Z"},"links":{"cited_paper":"/paper/2310.11513","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:c665581f5743d7f9f5095c161508c92c4b447b7cce4f43e83e3aa241c6a3e068","observation_id":"a6232f5e-e57b-4e22-8067-7ce4b08deea4","resolution":{"observed_at":"2026-08-06T17:31:34.346158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T17:31:34.429179Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.429179Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:b53e045e030fa67ca446ef23474ff79987c9f6de445313ff5ca283fff9523d57","observation_id":"cc6c57cd-d536-42e5-aa4c-c4684ada7e3b","resolution":{"observed_at":"2026-08-06T17:31:34.429179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-06T17:31:34.514689Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.514689Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:a92ba4a97c6b71cf0a61ea18710187e2a07d17d34b8b383ddddb29c8d045cad7","observation_id":"99a54691-e904-436a-a7f1-86f6b5d41fd6","resolution":{"observed_at":"2026-08-06T17:31:34.514689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.591907Z","title":"Hamilton, Jure Leskovec, and Dan Jurafsky","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.591907Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:8dae817d029dbdc0d78f667f54e56813600774ff50d6f396d94c9b1b5af14fac","observation_id":"61e59509-d644-459f-b5bd-d17d7069c394","resolution":{"observed_at":"2026-08-06T17:31:34.591907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.543","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"c8424009-c0e3-4b0b-be81-091268e4d988","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.673071Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:a33047cb09583bb156574d265b93c21c9ea2765ed8d883898b92f63319327e74","observation_id":"684e6410-5a1e-4fa9-9204-96212da2d80d","resolution":{"observed_at":"2026-08-06T17:31:39.354098Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06350","last_updated":"2025-03-08T14:57:45Z","snapshot_observed_at":"2026-08-16T15:16:44.005834Z","submitted_at":"2023-07-12T17:59:42Z","title":"T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06350","snapshot_observed_at":"2026-08-06T17:31:34.759041Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.759041Z"},"links":{"cited_paper":"/paper/2307.06350","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:5b1c3e534071356d92858c821e659c97d73597acfec689b7806e66480a155b59","observation_id":"9663b61d-8c42-451b-b1a5-acbf264ea2d5","resolution":{"observed_at":"2026-08-06T17:31:34.759041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01497","last_updated":"2024-01-16T19:00:56Z","snapshot_observed_at":"2026-08-16T15:11:11.273739Z","submitted_at":"2023-08-03T01:46:27Z","title":"Large Language Model Displays Emergent Ability to Interpret Novel Literary Metaphors","version":3},"cited_work":{"arxiv_id":"2308.01497","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.01497","snapshot_observed_at":"2026-08-06T17:31:39.878966Z","title":"Large Language Model Displays Emergent Ability to Interpret Novel Literary Metaphors","venue":"cs.CL","work_id":"300d0322-3d1c-494e-8f2b-8c2bb4722bf3","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.840851Z"},"links":{"cited_paper":"/paper/2308.01497","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:54697f8c1d532356bc0f40d0295ad1a0f7386e238c34a5c029fbea33deb79eca","observation_id":"bb24b995-1828-4c5f-b1aa-6ad532618554","resolution":{"observed_at":"2026-08-06T17:31:39.885197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T17:31:34.919903Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.919903Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:dedc5b63cdbb3a35ca43145e61e5ddeda21285a65d142e7327f3171bb09b83b3","observation_id":"ab6c11f3-17d7-432a-bef1-fb778d04168c","resolution":{"observed_at":"2026-08-06T17:31:34.919903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.518672Z","title":null,"venue":null,"work_id":"d2f71745-b249-4780-bcf6-2b998b3b1bd8","year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.981072Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:cc14506551f0729e8538d2356b22a27765abd1d42c5a7ab798bf874f5b81e1de","observation_id":"3993af14-b5fb-4359-887d-288ad06658a8","resolution":{"observed_at":"2026-08-06T17:31:40.523932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.500943Z","title":null,"venue":null,"work_id":"75382eee-fbb3-45ec-8090-f54968068f9b","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.041653Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:df8f7669f1983146f4660b9188002a7473de2a3ff0e3dca8fb25c4db7d9573c2","observation_id":"268d08d3-6707-4dae-8b85-1b6530e3acd3","resolution":{"observed_at":"2026-08-06T17:31:40.506351Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18569","last_updated":"2025-08-26T00:04:01Z","snapshot_observed_at":"2026-08-16T04:40:08.944110Z","submitted_at":"2025-08-26T00:04:01Z","title":"The Mind's Eye: A Multi-Faceted Reward Framework for Guiding Visual Metaphor Generation","version":1},"cited_work":{"arxiv_id":"2508.18569","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.18569","snapshot_observed_at":"2026-08-06T17:31:39.786437Z","title":"The Mind's Eye: A Multi-Faceted Reward Framework for Guiding Visual Metaphor Generation","venue":"cs.CL","work_id":"ba1cfb11-eb1c-4392-b5f2-e6d3ad22d892","year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.181178Z"},"links":{"cited_paper":"/paper/2508.18569","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:83be05208a6165fb8b69de3d39d173895c26d7fd95363f0b9ef8c73c71d9085a","observation_id":"c46e877d-ac7b-4a80-bf63-77e5c04c2fa2","resolution":{"observed_at":"2026-08-06T17:31:39.793756Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:35.343364Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.343364Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:e3dffec6d14f2ed62ae38dde474e01480d833ce4709a11a06d69f29bbfcf0b67","observation_id":"8e2d87b0-9af3-4dce-88ce-ad8fdd636554","resolution":{"observed_at":"2026-08-06T17:31:35.343364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.468560Z","title":"1980.Metaphors we live by","venue":null,"work_id":"eb70df4f-2a8a-4a18-a00c-ff06abd2400b","year":1980},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.412528Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:1c334e53add5c1b48aa89d355c03ff24d5ebbba625f54f2c8411bf9b6c881ff4","observation_id":"f88db841-16df-4fd2-a3cc-4f2d644ace78","resolution":{"observed_at":"2026-08-06T17:31:40.474508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d18-1183","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"65db012d-8e1a-4f99-80cc-422a39afb2b2","year":2018},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.500192Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:e0bbe6348466364ce6a2f353e8c0de9c0d37adf179e07449840b53826e1aae35","observation_id":"c63ba13f-31f4-48a4-925a-19eead8c9ef3","resolution":{"observed_at":"2026-08-06T17:31:39.329794Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.451850Z","title":null,"venue":null,"work_id":"b2612eb1-ff58-45e8-821d-4549cf734219","year":2018},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.567268Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:71e6a92c94afab91a543d608021a3fa42024f4cc3acb96ff2a8b6cd8ce82d037","observation_id":"6b276f82-2d4a-44c2-8e72-5879b568fde9","resolution":{"observed_at":"2026-08-06T17:31:40.456946Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18269","last_updated":"2026-04-18T01:27:45Z","snapshot_observed_at":"2026-07-31T09:20:56.277495Z","submitted_at":"2025-04-25T11:27:44Z","title":"TextTIGER: Text-based Intelligent Generation with Entity Prompt Refinement for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18269","snapshot_observed_at":"2026-08-06T17:31:35.642989Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.642989Z"},"links":{"cited_paper":"/paper/2504.18269","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:ee27218774994afae07dea5d03367f8b0d88291ad59be8a86e88896c0f472e42","observation_id":"456d995e-668b-4951-890f-ee7055ad6e94","resolution":{"observed_at":"2026-08-06T17:31:35.642989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.431476Z","title":null,"venue":null,"work_id":"7323b883-73d0-4f0d-8611-2d0209dc468c","year":2004},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.757919Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:61e50148a5492e20c20b46ba832862f73389082c09fff758d81c0efc2d55bc6a","observation_id":"7d31f9b5-4213-4ea1-aa53-3b29dd0746d2","resolution":{"observed_at":"2026-08-06T17:31:40.437987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:35.975942Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.975942Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:796af3fdf65eef4bcf2b3e9c964a638dbd63e030a71f54ab15c742488ab832f6","observation_id":"1540a356-4c63-420e-9293-5e1b683aff36","resolution":{"observed_at":"2026-08-06T17:31:35.975942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.396079Z","title":null,"venue":null,"work_id":"78d42a63-73f6-49e9-a646-53ff6bfd6337","year":2020},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.163381Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:4554b9b00712c591241e9254908d563fe1225c732da343646a5bd8ec737b3f51","observation_id":"35c8556e-4a2c-4e61-b329-810663fac3a6","resolution":{"observed_at":"2026-08-06T17:31:40.403026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.372771Z","title":null,"venue":null,"work_id":"a74958f5-0d54-4b1f-85e4-9c3f93151fbf","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.254120Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:aa67d9528f0588b00a79920b5000b34e27600fa37cadd3d119981877b45b8495","observation_id":"f3375d08-6b06-4f26-966e-1daca7127117","resolution":{"observed_at":"2026-08-06T17:31:40.380132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-06T17:31:36.388863Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.388863Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:8a9a52d3bd8236d125e639d0d72f2b2d930bc2f0dbf6ecaeb75bce10bb043505","observation_id":"82a34f17-8ba6-42a9-b3eb-e1a5b99055d4","resolution":{"observed_at":"2026-08-06T17:31:36.388863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.346601Z","title":null,"venue":null,"work_id":"2e72905e-885f-4610-a9ea-769010cf76c1","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.491343Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:375ed9cd329522fa96f6965d1c21ab80888df493e68c152608ec7491a66119d1","observation_id":"c4db93e8-e5e8-4e93-88f5-d69288c55a21","resolution":{"observed_at":"2026-08-06T17:31:40.355008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:36.666373Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.666373Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:c444390f3de87cc8b6a9ad2731e81e03c1ca07b16f5673ea754b2656e31e5b0f","observation_id":"a183f4bb-60e6-489c-b7fa-b1e1dfebd484","resolution":{"observed_at":"2026-08-06T17:31:36.666373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.314898Z","title":null,"venue":null,"work_id":"7c356a13-b5fb-4aac-b78b-93ef271501c9","year":2010},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.774378Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:7319f8448ae66642f8f2dd16e84490170f628887322960f3aba052a3b8484bd5","observation_id":"43b9448b-4ac8-4491-88e8-c79160ed355c","resolution":{"observed_at":"2026-08-06T17:31:40.322694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.conll-1.26","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"4d1ba0c1-6968-4339-91ff-cc75c7618a32","year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.869720Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:ec1fcc3b666df750f59df9564b7148b4a163277bd80890545d8038d8cc6439c2","observation_id":"2ef80b43-7217-4b7d-a193-ad5250fbefad","resolution":{"observed_at":"2026-08-06T17:31:39.250149Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:36.966020Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.966020Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:25dccedd204aee2c8f8ffc8af2b954a25f7c846f677d5369b71d3f2c0c240b16","observation_id":"13a086f2-d097-4c83-95d1-05127b2b74a6","resolution":{"observed_at":"2026-08-06T17:31:36.966020Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11063-024-11609-w","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:03:40.895421Z","title":null,"venue":"Neural Processing Letters","work_id":"97e5440d-5aab-4f6b-b225-829f6bf7d014","year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.158721Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:97fc02a3f280cf9a7202e61024f3089b807b7393b1f03b0a6b24d447c21d06d1","observation_id":"c549d93e-df66-47f0-89e8-89e76f11d851","resolution":{"observed_at":"2026-08-06T17:31:39.222406Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17472","last_updated":"2025-08-24T17:59:38Z","snapshot_observed_at":"2026-08-14T07:31:00.223869Z","submitted_at":"2025-08-24T17:59:38Z","title":"T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17472","snapshot_observed_at":"2026-08-06T17:31:37.253594Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.253594Z"},"links":{"cited_paper":"/paper/2508.17472","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:63caaf40141584ecfb2b5f9ad2f3d519015748f7aa754e369f7c78d5daaf888f","observation_id":"4cd0bbe0-3280-465c-82b0-20797e72b0d9","resolution":{"observed_at":"2026-08-06T17:31:37.253594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-06T17:31:37.323714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.323714Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:b2ccc1a2b347e85ff3e66eee09ccc5396b5093ad79b13c7e749906e40029fdc1","observation_id":"c237de48-395b-425c-bf44-dc17822a38ec","resolution":{"observed_at":"2026-08-06T17:31:37.323714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.286675Z","title":null,"venue":null,"work_id":"0e779cac-841b-4249-b58a-082905568649","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.401925Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:71cb0333db6711733a141330d899313d36958f1677670586ad8bd13f56ceb089","observation_id":"71d522d7-8479-474f-bc5b-fed186ba23b5","resolution":{"observed_at":"2026-08-06T17:31:40.294473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.265520Z","title":null,"venue":null,"work_id":"ed197e17-4cf0-4666-9e4c-2b0c87b13f73","year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.589884Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:14eb64d92a4768eed30697d4af9c04aea48ea1279e932e2fa75e8e76439956d9","observation_id":"c655b54e-16cd-409b-ad92-caeeebb69fdc","resolution":{"observed_at":"2026-08-06T17:31:40.272074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.naacl-main.372","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"1fd55779-5455-4472-8933-0c7a0c7580dd","year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.797508Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:7395da31e3ade4717066247d180a3b947dd560a4a4535e074fedba88d46723b6","observation_id":"941867f8-c1a5-4269-82df-350cea27247c","resolution":{"observed_at":"2026-08-06T17:31:40.249514Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.findings-emnlp.236","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"95488098-f16c-4706-a7f3-07721a625ecc","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.896531Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:54bc0b53368a5c58b5db57169f421481d19d8edc645d5971388e39e863406d47","observation_id":"8f6327c5-46fc-4dee-9672-1fef576f2c0d","resolution":{"observed_at":"2026-08-06T17:31:38.897206Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:38.009217Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.009217Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:c4a97620939aeed8984f47e32929fa5edc520194e00cffb7e3aaf0e23f80778c","observation_id":"0d50bccd-528f-4eea-ab02-a192bd6233a5","resolution":{"observed_at":"2026-08-06T17:31:38.009217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-06T17:31:38.056722Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.056722Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:a15e8a796c83b2d8637e9b0cad06b465e1b5a7c06a93970b23e1cd00e0a43f09","observation_id":"67b9d605-b279-4c09-b5eb-8f526ae3b25f","resolution":{"observed_at":"2026-08-06T17:31:38.056722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:38.135700Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.135700Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:ac169633011ac3eba99d80b5b0ef37c0335264187c8cc36d2b18325f38febaaf","observation_id":"c4dd0ddc-5408-44ae-a5e3-b14e071fe0bd","resolution":{"observed_at":"2026-08-06T17:31:38.135700Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:38.261105Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.261105Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:4871e27e45108e39a9ce2a9b4bcdc26ba28e130ba7d4d2098bb51c32aa95adb7","observation_id":"25d4b3b5-b210-4d8b-a8e7-cf1c08c93b6c","resolution":{"observed_at":"2026-08-06T17:31:38.261105Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.221043Z","title":"{template_phrase}","venue":null,"work_id":"0c650c06-a9df-498b-963d-717d8d920293","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.440967Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:7850edc885b9d2b1bf2aab5703ff025c665de547b2eb655c591be6784804f684","observation_id":"932b65d7-12c3-4312-a38e-2a570d7ea0f2","resolution":{"observed_at":"2026-08-06T17:31:40.227980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/1470593104044089","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Marketing Theory","work_id":"ba1d5225-33c4-46b2-8170-cf0179117f58","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":136,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.881739Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:fa37ca31b00546e68cd982a0a9a9b9995121923937306efd07f222a1a2d754ea","observation_id":"3a968c5c-8a4f-49af-afc6-3ef0980b2c35","resolution":{"observed_at":"2026-08-06T17:31:39.301899Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-06T17:31:36.073835Z","title":"arXiv:2103.00020 [cs.CV] https://arxiv.org/abs/2103.00020","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.073835Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:77a5c41a5b53d8df29bf1fbd8d5f2b522b17ced85466743da3868b3b4382980e","observation_id":"9fff1ed8-cdf7-457a-8368-30cbf4fd95c8","resolution":{"observed_at":"2026-08-06T17:31:36.073835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10578","last_updated":"2022-10-19T14:20:05Z","snapshot_observed_at":"2026-08-16T16:22:51.239337Z","submitted_at":"2022-10-19T14:20:05Z","title":"Language Does More Than Describe: On The Lack Of Figurative Speech in Text-To-Image Models","version":1},"cited_work":{"arxiv_id":"2210.10578","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.10578","snapshot_observed_at":"2026-08-06T17:31:39.821169Z","title":"Language Does More Than Describe: On The Lack Of Figurative Speech in Text-To-Image Models","venue":"cs.CL","work_id":"ffa501b7-3cc5-4cc7-8a33-914982f26ef4","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.097565Z"},"links":{"cited_paper":"/paper/2210.10578","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:96a64888e9c4af876347537d2e8864e82dca5b18d5062632a3b6b1fa71b80b7f","observation_id":"8af9640a-1555-4c62-ab41-fea98f66265c","resolution":{"observed_at":"2026-08-06T17:31:39.827577Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:37.495549Z","title":"InProceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), Lun-Wei Ku, Andre Martins, and Vivek Srikumar (Eds.)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.495549Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:76199fb9e70b2f8bf753cb3b9f92e3daf89e03dafd29106b64b068aee0fd99a9","observation_id":"cb21c4f9-16b5-44e1-ad1f-1a18409cf072","resolution":{"observed_at":"2026-08-06T17:31:37.495549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:37.685731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":3536,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.685731Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:d4fae277691ee526d246691077eca44c104dd867d4679192fc06efc93cabbb62","observation_id":"12190968-a8a2-4bfc-b633-fb3fcaae6066","resolution":{"observed_at":"2026-08-06T17:31:37.685731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T15:27:50.643309Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":4,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":38,"verified_exact":9,"verified_fuzzy":2},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2608.04750."}