{"as_of":"2026-08-09T21:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f2c86f994a488283b9e521967a336b75109742d506b040f835e7f08df98d52e4","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:21:04.518074Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.06823/citation-record","integrity":"/paper/2502.06823/integrity","json":"/paper/2502.06823/citation-record.json","paper":"/paper/2502.06823"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.979872Z","title":"GPT-4V(ision) System Card","venue":null,"work_id":"ccf3cc00-d2b7-4d20-a9dd-d7eee229865e","year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.317409Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:bcf594d858c76edc1d17726a27e5786adf1f0a28c588996a1d258dc64a2c827d","observation_id":"573e39ce-66f8-43fd-83b3-7d88ab581f50","resolution":{"observed_at":"2026-08-09T10:21:04.982973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.971244Z","title":"Claude3.5-sonnet","venue":null,"work_id":"772aeb76-4096-440c-9cad-a8732fda9612","year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.321856Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:00182ddf83d61a203fcb4e3a8615386027958eb96048c735b85b3c561c4402eb","observation_id":"af7db7d5-3e8a-423f-a2cb-58fa1645c7da","resolution":{"observed_at":"2026-08-09T10:21:04.974209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T10:21:04.326027Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.326027Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:070bdd948dca514cb6f9bae072d6069212b078e4b2f493bd47380697f582abf6","observation_id":"b1eac20c-81ca-4f65-81dd-ea93a1934e5b","resolution":{"observed_at":"2026-08-09T10:21:04.326027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-09T10:21:04.329943Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.329943Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:655025d64e3549604deee7a01fbef9de86d84a22edcf25867fee54f8c8a19b6f","observation_id":"0b0a0dcb-58a4-43f4-a40d-46ca5694ebd6","resolution":{"observed_at":"2026-08-09T10:21:04.329943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09985","last_updated":"2024-05-16T11:05:41Z","snapshot_observed_at":"2026-07-06T18:15:11.806744Z","submitted_at":"2024-05-16T11:05:41Z","title":"VirtualModel: Generating Object-ID-retentive Human-object Interaction Image by Diffusion Model for E-commerce Marketing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09985","snapshot_observed_at":"2026-08-09T10:21:04.334096Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.334096Z"},"links":{"cited_paper":"/paper/2405.09985","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:8054feb98e7941fedcc921fb189fdb665e3b779d8db8e7e0937a1005b0f52cd1","observation_id":"f43d412b-78c0-4d41-a176-80b18f4f055d","resolution":{"observed_at":"2026-08-09T10:21:04.334096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00436","last_updated":"2021-02-28T09:39:24Z","snapshot_observed_at":"2026-07-06T10:45:18.957752Z","submitted_at":"2021-02-28T09:39:24Z","title":"Automated Creative Optimization for E-Commerce Advertising","version":1},"cited_work":{"arxiv_id":"2103.00436","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.00436","snapshot_observed_at":"2026-08-09T10:21:04.699315Z","title":"Automated Creative Optimization for E-Commerce Advertising","venue":"cs.IR","work_id":"254733fc-83b8-4337-9895-906c271da589","year":2021},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.338079Z"},"links":{"cited_paper":"/paper/2103.00436","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:6194922e059c37202745cce5d0bcc3b2f97ffd57ef3f2b1c460fd92c935203fe","observation_id":"fb68a6ca-45a2-4d11-aeea-acc6f0817c89","resolution":{"observed_at":"2026-08-09T10:21:04.702892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.342470Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.342470Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:aa69d269ceaa3da018e805183a854ea09fc67b015d97a26674b7c4e12cd2c2dd","observation_id":"552f12f7-4bb6-47aa-807c-e82380cb9be3","resolution":{"observed_at":"2026-08-09T10:21:04.342470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.345838Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.345838Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:ee1b4bc9f7a3afaeb4a4972a8c49bed82b8465e106abba8b993f914546b7e815","observation_id":"61b92cd8-e472-46a4-b32a-bfed74228259","resolution":{"observed_at":"2026-08-09T10:21:04.345838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.951459Z","title":null,"venue":null,"work_id":"976d9e1d-ada3-41aa-8695-f0dfa9907b82","year":2025},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.348987Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:7eb2756338cacc8f49cd59eaa1f17271fe6956bafd99737e6b29598e419e223a","observation_id":"ae7c13fa-7d58-47a8-b525-d03a9ba0108a","resolution":{"observed_at":"2026-08-09T10:21:04.954982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.943510Z","title":null,"venue":null,"work_id":"ff7532c5-ad41-49fd-86df-5f7c3a5f54a9","year":2018},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.352300Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:eb4d464dd91e3a6d7c70a2a8175903fd9b2f463b38dc83f55223d7585a22b3ff","observation_id":"7ede1833-9310-46af-8e71-f97b3b55f366","resolution":{"observed_at":"2026-08-09T10:21:04.946028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-09T10:21:04.355550Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.355550Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:165b7a9a0ff8df525966e8c7977cf21b8d2dd92255262fc07197d035568760e3","observation_id":"b6ed7166-bbdc-43da-aa56-0d0964fb5559","resolution":{"observed_at":"2026-08-09T10:21:04.355550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.935898Z","title":null,"venue":null,"work_id":"94b79c54-bedb-4063-960e-93dbfc8095b9","year":2020},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.358979Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:7bb1fa23cc74a5dba6b20990eaa0ae320cbfe6a3d4322ffac24fd9b35c0cc8e5","observation_id":"76e4ea9b-114a-4bef-a73b-c8b2a3943581","resolution":{"observed_at":"2026-08-09T10:21:04.938489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.926920Z","title":null,"venue":null,"work_id":"c9a6a056-a9e7-4432-a45e-91b35b05fbd6","year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.362096Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:f604d5c4d0bc0311ffe193330662fc6564f1f6242dfff4c1e15f8512a7fc439f","observation_id":"6dd6f3a0-2e33-4f51-a7f9-2ef33fc5b701","resolution":{"observed_at":"2026-08-09T10:21:04.930074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-09T10:21:04.365406Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.365406Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:cebb54ee7a04bcfa7e59659e7f91ae14804209f4b566be8ca89bc5565cddd1af","observation_id":"4e3ca265-3b7b-43af-90b6-1bf02ad0b3f0","resolution":{"observed_at":"2026-08-09T10:21:04.365406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.918283Z","title":null,"venue":null,"work_id":"10c1d104-6d7e-4108-b8f0-52b5161ced2b","year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.368616Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:c2b2ff34e0883cb5ad8118c05ae31b35eacb7c3db64e5ab283fbb8723517c262","observation_id":"5e677ecd-9e1b-4968-b0ef-6624effdf3cb","resolution":{"observed_at":"2026-08-09T10:21:04.921369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.909766Z","title":null,"venue":null,"work_id":"12a588eb-d749-411a-ad3c-eadbb9d4dd8e","year":2017},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.371420Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:8b5723bca03c5df58d60f1aff23073b784ca82ba8c858c687d1dfa8454043a40","observation_id":"a4768d2b-01d5-49d3-908a-1062fc90987b","resolution":{"observed_at":"2026-08-09T10:21:04.912836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.374251Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.374251Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:6b1d6d986e32046e2049cfb7cbe83d6376b80f1b8d71810d46d8d077739c4f9c","observation_id":"399fb1ea-985a-4da7-9059-34a0d5bd7b20","resolution":{"observed_at":"2026-08-09T10:21:04.374251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15326","last_updated":"2023-07-28T06:04:46Z","snapshot_observed_at":"2026-08-09T09:34:23.046504Z","submitted_at":"2023-07-28T06:04:46Z","title":"Staging E-Commerce Products for Online Advertising using Retrieval Assisted Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15326","snapshot_observed_at":"2026-08-09T10:21:04.377388Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.377388Z"},"links":{"cited_paper":"/paper/2307.15326","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:ebeb2fdf0ba014ae6acfc123a7eedc8311252ed9bf88922d2cacb78f04c7b55f","observation_id":"f05959b9-fdaf-4f17-a3ad-e71751165173","resolution":{"observed_at":"2026-08-09T10:21:04.377388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.896422Z","title":null,"venue":null,"work_id":"a4e4e22c-2f14-482e-8986-fa709ec4585d","year":2015},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.381436Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:eec9bcba0383cb54ce0076430ffb198fb6020b8cf04ea6dfd2a144c957de8c41","observation_id":"49844fd4-aac2-4666-b222-303b0642c919","resolution":{"observed_at":"2026-08-09T10:21:04.899064Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-09T10:21:04.384719Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.384719Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:acf013bfb9e05504045ad54e91672c75cbc065603418d018a0a170ccddd194c7","observation_id":"440a0ad7-3a90-4533-9ffe-c838327daa03","resolution":{"observed_at":"2026-08-09T10:21:04.384719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05675","last_updated":"2024-07-15T17:19:18Z","snapshot_observed_at":"2026-07-06T17:14:07.183954Z","submitted_at":"2024-01-11T05:36:36Z","title":"Parrot: Pareto-optimal Multi-Reward Reinforcement Learning Framework for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2401.05675","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.05675","snapshot_observed_at":"2026-08-09T10:21:04.656304Z","title":"Parrot: Pareto-optimal Multi-Reward Reinforcement Learning Framework for Text-to-Image Generation","venue":"cs.CV","work_id":"33b2778b-9c57-4a01-ad41-8b17c817bca0","year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.389374Z"},"links":{"cited_paper":"/paper/2401.05675","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:9c43be0e56d535f7b4997aa67d121a0564dab90748de0d0a6915acad4b736dea","observation_id":"f8769fff-0f6e-4fcd-bd43-9fb5e5c84714","resolution":{"observed_at":"2026-08-09T10:21:04.661823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-09T10:21:04.392994Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.392994Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:5952b12163fde50b095636937081d04cdcc28aee979b32faefa7f42e3d26f69c","observation_id":"66cc9f87-b8fd-41f8-a287-329117361fa8","resolution":{"observed_at":"2026-08-09T10:21:04.392994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.888495Z","title":null,"venue":null,"work_id":"79a7aeb3-4d39-4936-8597-32013816ed84","year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.396599Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:2ec3bdfa3a34717d74d36e2013d287a95a42e9b1d5011b718c5381dfb1fd9841","observation_id":"cbbde33e-de94-4f0e-b951-f19298e4018d","resolution":{"observed_at":"2026-08-09T10:21:04.891482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08822","last_updated":"2024-09-03T07:42:44Z","snapshot_observed_at":"2026-08-05T13:30:57.339252Z","submitted_at":"2023-12-14T11:11:50Z","title":"Planning and Rendering: Towards Product Poster Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08822","snapshot_observed_at":"2026-08-09T10:21:04.399795Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.399795Z"},"links":{"cited_paper":"/paper/2312.08822","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:b24210d86bdf09824aaf54ae73989fb698980930f05138bd0fa8191c50d25d9e","observation_id":"97536d1d-fd09-4765-b9de-ed33dd2e1f4a","resolution":{"observed_at":"2026-08-09T10:21:04.399795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.880282Z","title":null,"venue":null,"work_id":"0d99df8a-76d9-4e9f-a67c-d55daa716f2b","year":2022},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.402693Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:666a3f261a87ad93c486eb85dac8569ccb7f251b2a680068222ccfd0cd6b53af","observation_id":"10c47183-718f-446c-a059-5815d31923b6","resolution":{"observed_at":"2026-08-09T10:21:04.883441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.405809Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.405809Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:4889a637736720e7592d0675d67a939de9d80e62ecb90fe0cde517ca51bc56ac","observation_id":"4b00a659-a837-4800-b8a0-71987440db95","resolution":{"observed_at":"2026-08-09T10:21:04.405809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.409626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.409626Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:a6eab0dde59ec4ba5a5a2751bb585d620cd5d4f09fe637e6a9edf3b740dd2eda","observation_id":"aea2ad15-4eb8-49ce-ac70-401ab9b161c6","resolution":{"observed_at":"2026-08-09T10:21:04.409626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.412872Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.412872Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:56dec4bf1b31b56f9db77074e12d83dd8aa571ea20bdac5a1c9ec93ce8f779b8","observation_id":"87418e18-0b7f-46ae-8aa0-9e85aec1b85c","resolution":{"observed_at":"2026-08-09T10:21:04.412872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18765","last_updated":"2024-03-13T08:47:32Z","snapshot_observed_at":"2026-07-06T16:55:09.267685Z","submitted_at":"2023-11-30T18:05:52Z","title":"MLLMs-Augmented Visual-Language Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18765","snapshot_observed_at":"2026-08-09T10:21:04.415840Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.415840Z"},"links":{"cited_paper":"/paper/2311.18765","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:da90f2b3baaeaab8bd957b494f9e4ec627bdcde8342d838930ce9ef55d206748","observation_id":"a55146ef-907b-4b6f-9e75-7d0a2c6042b1","resolution":{"observed_at":"2026-08-09T10:21:04.415840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.419450Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.419450Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:4fffc09fcc2174ae09c914942ebe45b3fdb93024fd3ab7b68f31133ffb38deb7","observation_id":"72d815e2-d01f-4ea8-8c6e-57eb1c27c0b5","resolution":{"observed_at":"2026-08-09T10:21:04.419450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.851299Z","title":null,"venue":null,"work_id":"1320f7fb-3e43-46bb-aa6f-a803182a294f","year":2017},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.422709Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:c48a486b69fb22a40d7bd9ce98d5781ddf9b42da518982c2a31487ae770b9c9f","observation_id":"daa81b4b-1a00-48f9-90a6-37801e0d4331","resolution":{"observed_at":"2026-08-09T10:21:04.854588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.841353Z","title":null,"venue":null,"work_id":"1b7d0b6d-cf9a-453f-a652-3dc4a4335689","year":null},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.426026Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:62a5a3d5a8e30f8563fa38bae6949253c107eb3a33f2c517dffef8a453e1f7c9","observation_id":"0d6103ce-f325-4902-ae73-bcb4c4f70899","resolution":{"observed_at":"2026-08-09T10:21:04.845225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10592","last_updated":"2024-07-15T10:15:58Z","snapshot_observed_at":"2026-08-06T03:36:11.761274Z","submitted_at":"2024-07-15T10:15:58Z","title":"InsertDiffusion: Identity Preserving Visualization of Objects through a Training-Free Diffusion Architecture","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10592","snapshot_observed_at":"2026-08-09T10:21:04.433049Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.433049Z"},"links":{"cited_paper":"/paper/2407.10592","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:1165d84674a5cf5b1d62851e903db6defcc4a13506627bf61813ee48eb6faf32","observation_id":"e3052f73-5d80-4de0-ac5c-851cf26bdbc4","resolution":{"observed_at":"2026-08-09T10:21:04.433049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.436866Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.436866Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:dbac88ca6182ed4649c46bcc0c1c67b4267e421c76407d80a30d7eadae44b8bc","observation_id":"1ba466a3-6b6d-4a65-a4b3-690bf1dcf6c1","resolution":{"observed_at":"2026-08-09T10:21:04.436866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-08-09T20:26:15.885759Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-09T10:21:04.440337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.440337Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:8ae7f939be84af1860b4c0f2b1c28bb5ebfadc720cd0db9fe15cb05d75f41bd1","observation_id":"25ae02e9-7c4b-4a63-ac04-ab36d93532c7","resolution":{"observed_at":"2026-08-09T10:21:04.440337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.443458Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.443458Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:a7cc7b2be88c3e1259b9b6d654f7472eff71322dee98cb5e62774a7bc9e0a46c","observation_id":"5d1aa1ce-c045-4523-a964-440216ead3a7","resolution":{"observed_at":"2026-08-09T10:21:04.443458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.446514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.446514Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:c0e25b22bc3ee7e44be44351f6ab36a792e8d5e16f305b1008740d3b64ddb2ca","observation_id":"5978cfff-0941-4e74-9e27-3606aaf42850","resolution":{"observed_at":"2026-08-09T10:21:04.446514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.449626Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.449626Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:68a28697955857972f0af4ddc287f3e7843309b9d0e3ac95e2410a6deebe05db","observation_id":"7cfa4fee-0de6-457d-a8cb-fdefdfc527a7","resolution":{"observed_at":"2026-08-09T10:21:04.449626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.452679Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.452679Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:8bab233ad7fc92c9aeea8959639de9619ee500431e4ef0a99b19431017934591","observation_id":"03601e3a-f9f7-473e-a329-dc289c18610c","resolution":{"observed_at":"2026-08-09T10:21:04.452679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08358","last_updated":"2024-04-17T01:58:09Z","snapshot_observed_at":"2026-07-06T17:01:13.998131Z","submitted_at":"2023-12-13T18:51:34Z","title":"Distributional Preference Learning: Understanding and Accounting for Hidden Context in RLHF","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08358","snapshot_observed_at":"2026-08-09T10:21:04.459437Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.459437Z"},"links":{"cited_paper":"/paper/2312.08358","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:f863a6a716b0d83690587c26e258c114042533ed7f19653da041917172eff638","observation_id":"809a079d-4dea-4418-bbbf-009af9095b07","resolution":{"observed_at":"2026-08-09T10:21:04.459437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-09T10:21:04.462968Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.462968Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:9f1e52f1c562734bfa237eeef23623a9b98ce9190a8a7fc67fb94758c880a4b6","observation_id":"1db84dc1-4c39-406e-af91-29e7e7acfcd1","resolution":{"observed_at":"2026-08-09T10:21:04.462968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.466445Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.466445Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:2617b1c46e634664aba351bd1b84bf4c38f1ae1605cfba29220f8a0ba3fe5c76","observation_id":"61cd3770-ade1-471d-ad78-8f4e2e721c9c","resolution":{"observed_at":"2026-08-09T10:21:04.466445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-09T10:21:04.469811Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.469811Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:bc11e1f6b84c48583d3320378994863190695b543e1eaaeb070fa6921c31d4d2","observation_id":"f058a75a-dec5-4e87-9b1f-0ece9924d3c3","resolution":{"observed_at":"2026-08-09T10:21:04.469811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.794343Z","title":null,"venue":null,"work_id":"3f944da3-1b15-46ee-a63d-000942fe9b5e","year":2025},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.473359Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:d9c638fd347413ce418e1b54ed8d7ec021b7b751bdc748945617f77c1ae7e15e","observation_id":"8c75c8c8-d317-4c3c-8a4f-b6584317475b","resolution":{"observed_at":"2026-08-09T10:21:04.797023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.786262Z","title":null,"venue":null,"work_id":"ee4b70da-82fd-4f44-8180-0aa450c8c6c4","year":2021},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.476873Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:4659ad3301f38276153f098d8ec802f7b6d17f4abc69ade68e170c84eb64ce89","observation_id":"47da320d-5838-4f0d-a298-3c41d3525615","resolution":{"observed_at":"2026-08-09T10:21:04.789310Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.777836Z","title":null,"venue":null,"work_id":"a1860893-0fae-4e2c-9cff-87aaa24e7752","year":2022},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.479886Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:d3aa0a86cd796a4847aa09cc3c7b9f5de766ef6819038d1db3c8db9aa55e7683","observation_id":"7a264441-ac93-4a55-85fb-f1f92e32745b","resolution":{"observed_at":"2026-08-09T10:21:04.780793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.769059Z","title":null,"venue":null,"work_id":"9a8c1854-bbcb-4f2d-84f2-8e0b698cb18a","year":null},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.482771Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:474b16c13d628cc472836f833e63aab23ca8ac7d92de2479cad899b97d579e97","observation_id":"1d8e58a6-621e-408c-9891-b02510ee1f37","resolution":{"observed_at":"2026-08-09T10:21:04.772076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.08943","last_updated":"2022-05-18T14:17:04Z","snapshot_observed_at":"2026-07-31T16:56:00.791821Z","submitted_at":"2022-05-18T14:17:04Z","title":"CREATER: CTR-driven Advertising Text Generation with Controlled Pre-Training and Contrastive Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.08943","snapshot_observed_at":"2026-08-09T10:21:04.489281Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.489281Z"},"links":{"cited_paper":"/paper/2205.08943","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:ff5527c1602e9df6fe55d948931d0c940d34f371522622239f5b10acac65a23f","observation_id":"02214729-ae09-4a56-972a-d534ff51ab48","resolution":{"observed_at":"2026-08-09T10:21:04.489281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14420","last_updated":"2023-08-22T12:26:07Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T10:09:03Z","title":"Human Preference Score: Better Aligning Text-to-Image Models with Human Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14420","snapshot_observed_at":"2026-08-09T10:21:04.493153Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.493153Z"},"links":{"cited_paper":"/paper/2303.14420","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:70811d320542698354d7995c7848e36fc3addf3cda19b102cdad355bd17b5fb8","observation_id":"c21ec208-c9a7-49d6-9a60-fee05d2994ec","resolution":{"observed_at":"2026-08-09T10:21:04.493153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-09T10:21:04.497151Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.497151Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:857ed369cf9060523942b3bc58197c9fd3ac56f7bf2f2f6fde0c9e3071dc1f52","observation_id":"30796fdb-4f5c-4130-914d-ac951faed28a","resolution":{"observed_at":"2026-08-09T10:21:04.497151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.751487Z","title":null,"venue":null,"work_id":"f66ef127-9728-414f-ae98-c2b59415680b","year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.500628Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:25ecbb5a23ada993a9f62eb0c8ea0484ec726bf3304fc07c32e088bea30d9872","observation_id":"d902d521-e089-485a-80fb-9bd4fa3fa996","resolution":{"observed_at":"2026-08-09T10:21:04.754495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.743369Z","title":null,"venue":null,"work_id":"a2158407-e7a1-40b2-989f-2b913e7f7dfd","year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.504113Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:3f4c90e3b1de767f2972684478ed03391cd7ea169e52c7722f9d98a14144a1d4","observation_id":"11793dcf-bd01-4ff8-94ea-342bbaba5daa","resolution":{"observed_at":"2026-08-09T10:21:04.745921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.507592Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.507592Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:54ffdf259b8c6625703b04054792227a0ca0ef483f7bdd0c5ff3108a687d8ee2","observation_id":"3f695ff5-38f7-4c68-a1c2-e4578df26e4f","resolution":{"observed_at":"2026-08-09T10:21:04.507592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.730443Z","title":null,"venue":null,"work_id":"7811935d-cc78-49cc-b841-9f748b5ae302","year":2024},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.510983Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:b6e5e8f1dc740d5eb60f67a9c04c7c5f00d8f714f54e1a0de00c6635d7456ab7","observation_id":"b4a24bd5-a139-48f7-a65a-40c4975d4750","resolution":{"observed_at":"2026-08-09T10:21:04.733030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03708","last_updated":"2024-08-17T13:39:13Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:35:26Z","title":"Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03708","snapshot_observed_at":"2026-08-09T10:21:04.514398Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.514398Z"},"links":{"cited_paper":"/paper/2310.03708","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:aa85a24f721636db165156c100e412961c9443ab219da801225052f714ae130d","observation_id":"6ef36a64-32da-4ddd-bb6c-fa4640a687b9","resolution":{"observed_at":"2026-08-09T10:21:04.514398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-09T10:21:04.518074Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.518074Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:4539dac7e58fa482cb610f428bbdcc23e7437399caf559aa7c6c80f33de2ec81","observation_id":"4858aecf-2f71-47d2-becc-b5d8a2919bff","resolution":{"observed_at":"2026-08-09T10:21:04.518074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T10:21:04.456038Z","title":"arXiv preprint arXiv:1707.06347 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.456038Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:817434bb4195139ea7d3118c84b2804f2146c742dee2008985a50a448ec4ac49","observation_id":"ce686c5c-91c2-4d31-b531-35101dd9de28","resolution":{"observed_at":"2026-08-09T10:21:04.456038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.831636Z","title":"In Proceedings of the 29th ACM international conference on information & knowledge management","venue":null,"work_id":"ad61a7c6-4741-45d7-ba54-596a19a36eaa","year":null},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.429494Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:d84f8c35189172b25c08b474c6243d336e94772da61bf79f8cc13f14ad91fb8a","observation_id":"66b45bb6-1180-4efa-bd4d-8d866fb089ff","resolution":{"observed_at":"2026-08-09T10:21:04.835500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:21:04.759974Z","title":"In Proceedings of the 45th International ACM SIGIR Conference on Research and Development in Information Retrieval","venue":null,"work_id":"4abe6bfe-6237-4228-b576-1f066d74de62","year":null},"citing_paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T10:21:04.485933Z"},"links":{"citing_paper":"/paper/2502.06823"},"observation_digest":"sha256:a0cbc0ee6f388a380c36614ef6177921d3cc4aeab96130dbc7002cd176d8a4db","observation_id":"3587090c-c2a3-4a9c-938a-d4b5d3feba32","resolution":{"observed_at":"2026-08-09T10:21:04.763211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06823","last_updated":"2025-02-05T09:06:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T10:10:57.804473Z","submitted_at":"2025-02-05T09:06:02Z","title":"CTR-Driven Advertising Image Generation with Multimodal Large Language Models"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2502.06823."}