{"as_of":"2026-08-21T22:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba71cddca2b057df112506d4f63a0f8e2340348dd10ee82a323e512dc32bf52b","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:19:06.054448Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:32:11.864173Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T00:32:11.963954Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"cited_work":{"arxiv_id":"2507.03275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.03275","snapshot_observed_at":"2026-08-16T00:32:11.963954Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","venue":"cs.CV","work_id":"73b0dfcd-10da-4545-9fe3-f1820bab8048","year":2025},"citing_paper":{"arxiv_id":"2608.12426","last_updated":"2026-08-12T10:57:06Z","snapshot_observed_at":"2026-08-19T11:10:59.795583Z","submitted_at":"2026-08-12T10:57:06Z","title":"Large Language Models Can Follow Instructions, But Not Many at Once: Phase Transitions in Compositional Constraint Satisfaction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:32:11.864173Z"},"links":{"cited_paper":"/paper/2507.03275","citing_paper":"/paper/2608.12426"},"observation_digest":"sha256:f23ff13c7845c35bdd4b2b3f21e5106a8801c75d4764e56188b4405f9b957f93","observation_id":"7dbcb3fa-0ef5-48dd-9582-eb27d9401fe9","resolution":{"observed_at":"2026-08-16T00:32:11.971171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.03275/citation-record","integrity":"/paper/2507.03275/integrity","json":"/paper/2507.03275/citation-record.json","paper":"/paper/2507.03275"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:08.891371Z","title":"Stable diffusion 3.5, 2024","venue":null,"work_id":"1f05b0c4-f66e-4789-a0f9-1085cf978506","year":2024},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.109816Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:4bd01205261f97a62dc844e406536e43a702cc22d22e14f657d70916810f3467","observation_id":"7f2e7d9b-d3ab-4547-ae55-fff3055ea5cd","resolution":{"observed_at":"2026-08-06T20:19:08.940261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:08.644892Z","title":"Hrs-bench: Holistic, reliable and scalable benchmark for text-to-image models","venue":null,"work_id":"e7bd32fb-bbf0-46a0-9711-b9451fe21765","year":2023},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.226966Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:0a3ad85229263ee6a95efae2ab4e30401385514f8926ff072148edd6be1a3277","observation_id":"340efecd-c24f-458b-9a57-bcc7dcb7e6dc","resolution":{"observed_at":"2026-08-06T20:19:08.783185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-08-06T20:19:02.331506Z","title":"Diffusion Mod- els Beat GANs on Image Synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.331506Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:e892c558ccc52d3181096e991c8a91cf38decc5ef449a7f4c96aa310eda98e38","observation_id":"4c1aec9a-773f-4ae8-89ac-54fbabb5b82b","resolution":{"observed_at":"2026-08-06T20:19:02.331506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-06T20:19:02.451282Z","title":"Clipscore: A reference-free evaluation met- ric for image captioning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.451282Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:ba44a876300cd51e794408bc74044bdae727e54b567aa31a27571024ad999d11","observation_id":"3b0d1d31-54f9-4a40-a99a-94ff5ab76a71","resolution":{"observed_at":"2026-08-06T20:19:02.451282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-06T20:19:02.561573Z","title":"Denoising Diffu- sion Probabilistic Models","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.561573Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:304860eade94d0f797b18497d797293acebcba39a60233929ebdd38d45055750","observation_id":"ffe3038d-860b-4a63-80b5-eeade39fe95a","resolution":{"observed_at":"2026-08-06T20:19:02.561573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:08.386881Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":"ddae5a58-80c8-4aa4-85ef-52d3fd5701e4","year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.674020Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:57e9758161696dd5448d84202d397c42ca2fa811d94e0c70b0f812c94f9c7d64","observation_id":"2b1979a0-fafa-4bb4-bf22-dc297934c4b8","resolution":{"observed_at":"2026-08-06T20:19:08.510380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-08-17T13:08:14.312126Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-06T20:19:02.761667Z","title":"Video dif- fusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.761667Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:982a52452f04bb708a65c40f34f75bbda94a6af4a232659d02fa485fd2365cc5","observation_id":"6f4559ae-8e2a-4ba2-9846-1c936ae60273","resolution":{"observed_at":"2026-08-06T20:19:02.761667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:08.183478Z","title":"T2i-compbench: A comprehensive bench- mark for open-world compositional text-to-image genera- tion","venue":null,"work_id":"3c68a001-a247-42eb-a088-19b01282d827","year":2023},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.847797Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:a55c1146778efea3472b16ed294e7148348cd7946daf56fe932fbddf76b6ec74","observation_id":"6be8b32f-92ba-4214-8502-f2b425121930","resolution":{"observed_at":"2026-08-06T20:19:08.267168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T20:19:02.952834Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:02.952834Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:3667fee6d92254f78df4c5350b40452354774b97c19b6415084c2d46e8b03474","observation_id":"784b78fe-5cde-476a-9577-573d4a55737f","resolution":{"observed_at":"2026-08-06T20:19:02.952834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09761","last_updated":"2021-03-30T19:48:38Z","snapshot_observed_at":"2026-07-06T09:57:19.117228Z","submitted_at":"2020-09-21T11:20:38Z","title":"DiffWave: A Versatile Diffusion Model for Audio Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09761","snapshot_observed_at":"2026-08-06T20:19:03.050682Z","title":"Diffwave: A versatile diffusion model for audio synthesis","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.050682Z"},"links":{"cited_paper":"/paper/2009.09761","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:7fc0ae1b4932af3837dd482d32303f3c21f3c103382e9f1dc06d97d867cc2eaf","observation_id":"49dda0a4-25ab-4aad-9076-da6e8de8d196","resolution":{"observed_at":"2026-08-06T20:19:03.050682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-08-16T13:11:20.195602Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-06T20:19:03.122128Z","title":"Playground v2.5: Three insights towards enhancing aesthetic quality in text-to-image genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.122128Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:f38d7d7ea4cc4bd6c9d824dd7bb24676d648725726ce985ff1e28903de46a68f","observation_id":"6d8d44c1-f07f-4d56-a04f-97560f1ea6a5","resolution":{"observed_at":"2026-08-06T20:19:03.122128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:03.238325Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.238325Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:7ad7abb9c432dffed2d02f4e8f0ce9f00322a991cf695f4c2ac6ea1769021f49","observation_id":"15569571-d4e7-4e18-b1a2-93b09800926c","resolution":{"observed_at":"2026-08-06T20:19:03.238325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:03.343235Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.343235Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:c70d10d6659bb1d5fe5609d80d5bb0f103cbd0bde7e55bbf9b6c270956885c38","observation_id":"5047bfe0-fc84-4409-8e4c-e191b262316c","resolution":{"observed_at":"2026-08-06T20:19:03.343235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09672","last_updated":"2021-02-18T23:44:17Z","snapshot_observed_at":"2026-08-21T13:05:03.743549Z","submitted_at":"2021-02-18T23:44:17Z","title":"Improved Denoising Diffusion Probabilistic Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09672","snapshot_observed_at":"2026-08-06T20:19:03.465134Z","title":"Improved De- noising Diffusion Probabilistic Models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.465134Z"},"links":{"cited_paper":"/paper/2102.09672","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:5b75b02b462c529e8c7c78958f45350a364310f3503ae41d7647d94c17ad6c67","observation_id":"8d4431f7-df60-4b41-97ec-5d21ae0ad12f","resolution":{"observed_at":"2026-08-06T20:19:03.465134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-06T20:19:03.591105Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.591105Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:dd03f924f9772cdac893ef98f005d8fb7ced304eb7401bcc546c047090fcde9e","observation_id":"0da16185-7534-4098-8573-4c49a29da352","resolution":{"observed_at":"2026-08-06T20:19:03.591105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:07.922394Z","title":"Gpt-4v(ision) system card","venue":null,"work_id":"fe606182-8559-4e34-9bb4-f91082e856e5","year":2023},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.701387Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:45378f25ca5ffa1bc667feb2c56fe7bad507d758081c8a1f6abb01ef8a6cb601","observation_id":"089e6b1e-486c-4f92-b0e6-6e36da837645","resolution":{"observed_at":"2026-08-06T20:19:08.052892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:07.672466Z","title":"Dall·e 3, 2024","venue":null,"work_id":"8c463fc4-c5fb-4ec2-bf7c-57fe6fb5d633","year":2024},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.777819Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:9877a4bc59daa6a7ce66db2710da607fdd3b0ca89fbc0ce1eb03d2fbc96b8ab8","observation_id":"9a960b94-92d6-40cf-a570-1bb3a742425d","resolution":{"observed_at":"2026-08-06T20:19:07.777352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:03.872819Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.872819Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:1a0e8c6594da40c5fca1d2328189d40f062a707b7d0e5d78a29b372037824e5a","observation_id":"5ce37eeb-30f2-4321-8653-317b38a0f1a0","resolution":{"observed_at":"2026-08-06T20:19:03.872819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12112","last_updated":"2022-11-22T09:27:53Z","snapshot_observed_at":"2026-08-16T16:14:16.127867Z","submitted_at":"2022-11-22T09:27:53Z","title":"Human Evaluation of Text-to-Image Models on a Multi-Task Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12112","snapshot_observed_at":"2026-08-06T20:19:03.991593Z","title":"Human evaluation of text-to-image models on a multi-task bench- mark","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.991593Z"},"links":{"cited_paper":"/paper/2211.12112","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:c482ff0ea4640e1f642126920eb310281aafc13a6639bfb7dc3bdb5f3ede6b8f","observation_id":"f12a3e8e-914b-4d2a-9d80-1c7a02f10074","resolution":{"observed_at":"2026-08-06T20:19:03.991593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:04.119575Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.119575Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:e006c006301ea60c2e34e922b802cbc3953f0193fb97731e7e8e93d3cecc5cf7","observation_id":"3577ce06-0b97-4738-aea0-6b88bc4291a2","resolution":{"observed_at":"2026-08-06T20:19:04.119575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:04.245025Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.245025Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:384c8b0577e6c77712b96de26c619def9110beb5b9202789d9ad539f0ee59723","observation_id":"3ed04e8d-abe7-4dc2-a67d-7c910f24c6c2","resolution":{"observed_at":"2026-08-06T20:19:04.245025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:04.376106Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.376106Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:39c6172aa6654d02134508edb9c5af83407fd12827a72f344d301ed1ec94c48a","observation_id":"cc2c466f-553e-4e3a-9e45-05f5d15587d5","resolution":{"observed_at":"2026-08-06T20:19:04.376106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07636","last_updated":"2021-06-30T07:34:57Z","snapshot_observed_at":"2026-08-16T18:31:18.345286Z","submitted_at":"2021-04-15T17:50:42Z","title":"Image Super-Resolution via Iterative Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07636","snapshot_observed_at":"2026-08-06T20:19:04.519361Z","title":"Fleet, and Mohammad Norouzi","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.519361Z"},"links":{"cited_paper":"/paper/2104.07636","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:0542007adfce928962aaf131ad29b3766c8f8ea8531efc1e9b3864e090f05da6","observation_id":"b82c4b9e-227d-4a8e-9fc4-076865d87a82","resolution":{"observed_at":"2026-08-06T20:19:04.519361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:07.417143Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"daa0d5b2-874d-4b7d-a73d-96ba1b47b79a","year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.670806Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:4b1293d4b1f9a7281bb88c230b147d05410c3cea19bc4f796886840f02b30715","observation_id":"04560d81-e4b9-4713-82c0-1f409ae41fe8","resolution":{"observed_at":"2026-08-06T20:19:07.509268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-16T19:09:26.533311Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-06T20:19:04.794363Z","title":"Autoprompt: Eliciting knowl- edge from language models with automatically generated prompts","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.794363Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:14d45666bbd14eee20aea1e0c3623a608e7e9d4f07de210b2c1950b57875b957","observation_id":"fa5fece4-6226-4609-86aa-5169a591e997","resolution":{"observed_at":"2026-08-06T20:19:04.794363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05600","last_updated":"2020-10-10T07:46:19Z","snapshot_observed_at":"2026-08-01T16:44:46.833530Z","submitted_at":"2019-07-12T07:37:26Z","title":"Generative Modeling by Estimating Gradients of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05600","snapshot_observed_at":"2026-08-06T20:19:04.890656Z","title":"Generative Model- ing by Estimating Gradients of the Data Distribution","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.890656Z"},"links":{"cited_paper":"/paper/1907.05600","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:2f9edf12d7e4ca0ca386aa6a31f82579458efaf55dcfde231f0cfac2db80da59","observation_id":"8c23da9c-88a3-4767-b5a5-a5b10e0a6b7a","resolution":{"observed_at":"2026-08-06T20:19:04.890656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:04.990553Z","title":"Chain-of-thought prompting elicits reasoning in large lan- guage models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:04.990553Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:f02ea32cec51eac745ce2d07bb691e95fa724f0fcfe8d0679748962df87331f2","observation_id":"abc6d5b4-2bc8-449f-acf5-e57d69664c03","resolution":{"observed_at":"2026-08-06T20:19:04.990553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:07.242387Z","title":"Investigating prompt engineering in diffusion models, 2022","venue":null,"work_id":"f445fd93-4d69-420c-89b5-8b8ee79b07b9","year":2022},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.115049Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:d973253718df792d89696e743a11a28dd956d653023d531837fa7f9b3c198a47","observation_id":"544b703f-98da-416d-a8b5-fab22085f4ff","resolution":{"observed_at":"2026-08-06T20:19:07.311504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14339","last_updated":"2024-08-26T15:08:12Z","snapshot_observed_at":"2026-08-18T20:27:16.710347Z","submitted_at":"2024-08-26T15:08:12Z","title":"ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14339","snapshot_observed_at":"2026-08-06T20:19:05.209014Z","title":"Conceptmix: A compositional image generation benchmark with controllable difficulty","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.209014Z"},"links":{"cited_paper":"/paper/2408.14339","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:09591e646d201eca431c3cbadd167da2ca94ec8fb82ca61d6a52985413a70a85","observation_id":"27854b09-cafa-4f70-8168-d273cdaf3acc","resolution":{"observed_at":"2026-08-06T20:19:05.209014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-08-13T02:15:58.634561Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-06T20:19:05.358882Z","title":"Textgrad: Automatic” differentiation” via text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.358882Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:6d7525af98a5267eb57a811ac71e9087fea681acdb45bd582d7a7ed7ae946dc0","observation_id":"5f8fe5c6-1a0e-48d9-a5ab-215c65826b28","resolution":{"observed_at":"2026-08-06T20:19:05.358882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T20:19:05.475777Z","title":"Respond ‘Yes’ or ‘No’","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.475777Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:a7826a5081d8a1fba4ab59d84f33e23ca3f9fcdc47a1949d55b3b27cc6812ceb","observation_id":"9419ae14-56e3-48af-a03b-5afd9c9958e8","resolution":{"observed_at":"2026-08-06T20:19:05.475777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:07.045741Z","title":null,"venue":null,"work_id":"4691ac9b-28ae-4eac-b999-1b2a87c7e6be","year":null},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.600691Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:65cfb5e5f45c6f16f06c42c17c57455e19bdd261838311dbd2ff4e1d7d4d5571","observation_id":"4e074b25-4d05-4391-8968-e2962ad75531","resolution":{"observed_at":"2026-08-06T20:19:07.107010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:06.902339Z","title":null,"venue":null,"work_id":"59d56ded-65cb-48a3-94d9-f3b1289d19d8","year":null},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.718408Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:2a1e43c665a4b01cc416bc6a1249596eb7b102b2681a6005dd84eeed3ea1fdf1","observation_id":"66a5baae-ad92-486c-bbfa-e25e6cd451de","resolution":{"observed_at":"2026-08-06T20:19:06.975725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:06.783480Z","title":null,"venue":null,"work_id":"4c40ee57-799b-45a8-b656-9de11b6c37ef","year":null},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.823878Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:8418d07922e2b642c677d70da67819004b4960eb97e4a30f20a3d1f44d9db69b","observation_id":"a1ae57cf-e348-4206-90a8-cfb451c1a7ab","resolution":{"observed_at":"2026-08-06T20:19:06.836318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:06.652054Z","title":null,"venue":null,"work_id":"f920b7e3-65ab-410a-8f47-cd586f4344c8","year":null},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:05.953963Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:60d2ff4e9889240ae353b41e3e06bace6cca6825917aeff3bccf62220e851bf3","observation_id":"e86d9ce2-eae3-4245-b039-fe617cb8094b","resolution":{"observed_at":"2026-08-06T20:19:06.705018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:19:06.529358Z","title":null,"venue":null,"work_id":"92387e72-4e04-4b8d-9a26-6668c0036423","year":null},"citing_paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:06.054448Z"},"links":{"citing_paper":"/paper/2507.03275"},"observation_digest":"sha256:6fb307e02c169288d7d1f35811754bdf8a8d44d7e4cb1d2b416d698598deb9d6","observation_id":"b671e373-c077-47fe-b524-96f8b3b23f46","resolution":{"observed_at":"2026-08-06T20:19:06.567030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.03275","last_updated":"2025-07-04T03:27:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T19:34:08.362115Z","submitted_at":"2025-07-04T03:27:04Z","title":"ConceptMix++: Leveling the Playing Field in Text-to-Image Benchmarking via Iterative Prompt Optimization"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2507.03275."}