{"as_of":"2026-08-06T01:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8ef0d5337e2f032cf2c9ceba59e6651ac05f1d32b1b8574c5d5325f1151069ec","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T16:44:23.162726Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:46:26.361155Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25477","snapshot_observed_at":"2026-08-01T12:46:26.361155Z","title":"Ye, J.; Jiang, D.; Wang, Z.; Zhu, L.; Hu, Z.; Huang, Z.; He, J.; Yan, Z.; Yu, J.; Li, H.; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19341","last_updated":"2026-07-21T17:59:02Z","snapshot_observed_at":"2026-08-01T12:46:23.774907Z","submitted_at":"2026-07-21T17:59:02Z","title":"ExpertVerse: A General-Purpose Benchmark for Expert-Level Reasoning in Knowledge-Intensive Visual Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T12:46:26.361155Z"},"links":{"cited_paper":"/paper/2604.25477","citing_paper":"/paper/2607.19341"},"observation_digest":"sha256:ebcbf94f09166f587842b9a3f755cacc25aa910cb815bbc1c720634e7751cda0","observation_id":"7986f710-a863-4c66-abf6-9f4786b1f9fa","resolution":{"observed_at":"2026-08-01T12:46:26.361155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.25477/citation-record","integrity":"/paper/2604.25477/integrity","json":"/paper/2604.25477/citation-record.json","paper":"/paper/2604.25477"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen-image technical report","venue":null,"work_id":"4e82ee61-2863-4513-89c7-bd90376785be","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:9aab99fe6059b6ffecd14ba1de835bb3a99b5b668f67406fb46d7e596d3f8298","observation_id":"73740e02-0d96-42af-b0d1-c863b672fd23","resolution":{"observed_at":"2026-05-27T01:53:22.760044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux.1: Text-to-image synthesis via flow matching","venue":null,"work_id":"e4a127b5-eebc-4b38-bdd7-e14339a783f0","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:2f3f589cffa57432ea97b52278538b0c75b7affcd24cb4993e38042eadba37ab","observation_id":"da4a5169-94a5-481b-8ab0-f078f695bc58","resolution":{"observed_at":"2026-05-27T01:53:22.773716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07584","last_updated":"2025-12-08T14:26:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-08T14:26:40Z","title":"LongCat-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2512.07584","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.07584","snapshot_observed_at":"2026-07-04T16:09:57.573753Z","title":"LongCat-Image Technical Report","venue":"cs.CV","work_id":"648d9514-ca31-4ba0-983a-1aba1057a97e","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2512.07584","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:de8d1798bdf8e9449a4837beba006cdf343d8b760462c1b1ac1f45a3b7ec3be7","observation_id":"e6407dff-9705-4b86-afee-73f05f1833de","resolution":{"observed_at":"2026-05-16T08:04:13.097348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":"2105.05233","doi":"10.48550/arxiv.2105.05233","metadata_source":"pith","pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diffusion Models Beat GANs on Image Synthesis","venue":"cs.LG","work_id":"2eb944bb-93ba-462c-8111-4e8c915dd873","year":2021},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:1e27f4c36ede2aba552d39831b1d49f8b3f2b4384e2c2b8d6a5297952689937e","observation_id":"cf2b0ef5-1e57-459e-b41a-f72aca7847a8","resolution":{"observed_at":"2026-05-13T11:16:28.664120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:30.424112+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:30.424112+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":"4bfd39df-a698-4224-8bd9-fe40f5df81a4","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:94f83fccabd66dcf2c21f850708a1721fd060d8e3d895c6c9488d9efa5d4f537","observation_id":"29e42942-a3e1-4ebd-8478-6575cafff5a9","resolution":{"observed_at":"2026-05-27T01:53:22.770111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion model-based image editing: A survey","venue":null,"work_id":"db76edaa-ea42-46fb-a7cd-abee8abae7d6","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:27ea06a214bf32b67dc45426498dc7c0c580a1dbba1d01b85e1613a5bab203c2","observation_id":"9f34a434-2d96-44b6-ab1d-403f338e664d","resolution":{"observed_at":"2026-05-27T01:53:22.752553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available: https://doi.org/10.1109/TPAMI.2025.3541625","venue":null,"work_id":"61215446-970c-4179-a738-60252b351b8c","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ac58c4bbc819af9437b42146e339ee6367441d8d69f050c412f402115dcb0d1b","observation_id":"cabc0059-27d7-411b-9ee9-83a62f687b16","resolution":{"observed_at":"2026-05-09T01:54:33.528913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2025.3636582","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Freeedit: Mask-free reference-based image editing with multi-modal instruction","venue":"IEEE Transactions on Pattern Analysis and Machine Intelligence","work_id":"3850b5ce-2d2f-4978-b360-761018517aa1","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:0d41a3d0293b8c3ade13e35cdfd0c53e3760dd22394fd4be949ea0c358ff20e5","observation_id":"f72f2bd4-68eb-4927-84df-9deef36d0aba","resolution":{"observed_at":"2026-05-09T01:54:33.337125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"1d32bb17-e146-4ca8-abcf-ec2f8a71cf87","year":2023},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:99f22925a3825088d460eafd290ba6845d03b08bf6cf097896ab064c170d54e8","observation_id":"ad58f7de-10e7-4ba9-8171-728d7b61b5c1","resolution":{"observed_at":"2026-05-27T01:53:22.725917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2025.3597936","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Opencir: Conditional image repainting with open condition mixture","venue":"IEEE Transactions on Pattern Analysis and Machine Intelligence","work_id":"c1058fae-600c-4a54-9c09-811c23bdf2c2","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ad8a9757f4d4a884eb8f1ff51de7ae0ce20f9e3d8d9592fc3e51a14c1336a941","observation_id":"bb741fb7-3229-4ecf-a488-0edd62e06dc6","resolution":{"observed_at":"2026-05-09T01:54:33.440860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":"2504.17761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-10T01:46:41.223286Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","venue":"cs.CV","work_id":"3392f2c8-a1cb-4d6c-8c82-2cdccffa33f9","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:db30b7d4636a6ddd530a5a1f6189b17226ef814c9b3bce1e8519029d6c20baf6","observation_id":"9a8624f9-312b-4bea-a374-182e61e83d85","resolution":{"observed_at":"2026-05-11T23:36:15.161347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19312","last_updated":"2025-03-25T03:18:46Z","snapshot_observed_at":"2026-07-06T20:58:10.509344Z","submitted_at":"2025-03-25T03:18:46Z","title":"ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2503.19312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19312","snapshot_observed_at":"2026-06-30T06:54:20.724189Z","title":"Imagegen- cot: Enhancing text-to-image in-context learning with chain-of-thought reasoning","venue":null,"work_id":"a63b0f16-d213-4a68-acaf-873d8cdcf1b1","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2503.19312","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:aea5f01be189412df761a84987ad9c9285ca1e2355d435d35918e8421d0c448f","observation_id":"828ea5b4-6b90-4c8a-a609-701280c1e461","resolution":{"observed_at":"2026-05-11T23:36:14.891845Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T2i- compbench++: An enhanced and comprehensive benchmark for compositional text-to-image generation","venue":null,"work_id":"53b25587-9cc8-487c-b8a2-64e46fc645ba","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:8fca9428ef14919356d5f394a3a299dd04329b2f85e1fe2e29bd6f9b6f50dc23","observation_id":"3736c31e-088e-43c5-9a0d-6b294d69ec5a","resolution":{"observed_at":"2026-05-09T01:54:33.360355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13655","last_updated":"2024-03-04T18:43:49Z","snapshot_observed_at":"2026-08-01T21:33:07.884113Z","submitted_at":"2023-05-23T03:59:06Z","title":"LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.13655","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13655","snapshot_observed_at":"2026-07-04T16:39:58.233736Z","title":"LLM-grounded diffusion: Enhancing prompt understanding of text-to-image diffusion models with large language models","venue":null,"work_id":"5c6b2f10-7c7a-4f99-9895-3524faeea08d","year":2023},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2305.13655","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:340ead95c8d0526efc3526af92d1b0c1e35757d86e1a8c26f4034b2c06e2a07b","observation_id":"3afb7641-7d3e-4996-8de2-cc175bde9563","resolution":{"observed_at":"2026-05-11T23:36:14.439069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Editthinker: Unlocking iterative reasoning for any image editor","venue":null,"work_id":"39076d9d-451e-4e58-a956-7c9ce6d96c1f","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:9d6d49bf4a8c67cf4d73af656c653763f294f32b6e74595f99ca1f9c4a7688fa","observation_id":"04fc640f-7be7-417c-995c-3be27584dd79","resolution":{"observed_at":"2026-05-27T01:53:22.742542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.22228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialreward: Verifiable spatial re- ward modeling for fine-grained spatial consistency in text-to- image generation","venue":null,"work_id":"2bc76e96-a9d0-4e83-a2d3-9bd60d7d634a","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:4293f80c56f1cd0e356571d871bbaa943a1fcdb0066a2dbc59a2be85c72d4cb9","observation_id":"16a7fbc1-2d8c-48ad-8c84-ba5171ba6826","resolution":{"observed_at":"2026-05-11T23:36:14.468761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating compositional text-to-image generation: A benchmark and analysis","venue":null,"work_id":"d4703196-5c48-479f-8525-aa73fc316405","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:941e2b1f1eea414aa3fe1dc9ddb64afee65e3063f88326d097b5fa93983251e1","observation_id":"899c43b0-7284-45d5-8a66-1a0a484e91e6","resolution":{"observed_at":"2026-05-27T01:53:22.732948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02826","last_updated":"2025-05-27T15:54:58Z","snapshot_observed_at":"2026-07-06T21:03:50.078667Z","submitted_at":"2025-04-03T17:59:56Z","title":"Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing","version":4},"cited_work":{"arxiv_id":"2504.02826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.02826","snapshot_observed_at":"2026-07-04T13:19:50.681869Z","title":"Envisioning beyond the pixels: Benchmarking reasoning-informed visual editing","venue":null,"work_id":"e46f260d-7abe-40b5-9905-5115e6088591","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2504.02826","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:924408eebfb9903084eeeae0b4913098b995ae230ba9d4d4abc43de11793a2e1","observation_id":"b303e3d6-e2f8-47f2-ac89-4f9147c95d6b","resolution":{"observed_at":"2026-05-11T23:36:14.352173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03127","last_updated":"2026-04-03T14:36:47Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T15:59:33Z","title":"Unified Thinker: A General Reasoning Modular Core for Image Generation","version":2},"cited_work":{"arxiv_id":"2601.03127","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.03127","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unified Thinker: A General Reasoning Modular Core for Image Generation","venue":"cs.CV","work_id":"f100446e-4c27-4057-8f7a-a5581ea46f76","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2601.03127","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a3566fa33b304903d4484562f45d18f27f3b8ffb41418c53b337b853336e7060","observation_id":"27ecd09a-cb02-4b5f-8f12-068f456b3d98","resolution":{"observed_at":"2026-05-11T23:36:14.310359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03467","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:09:50.785943Z","title":"ThinkRL-Edit: Thinking in reinforcement learning for reasoning-centric image editing","venue":null,"work_id":"ec758740-6125-46f6-9ab5-9b012131883f","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:90a257d5ac3888403a95cef8d1a75746f6dc130ac293ad37bed6056f01d41706","observation_id":"fc5f3209-64c3-4ef7-ae61-48c2e210d57c","resolution":{"observed_at":"2026-05-11T23:36:14.406277Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:09:50.812115Z","title":"Thinkgen: Generalized thinking for visual generation","venue":null,"work_id":"e7b9510c-c818-4bbc-9fcd-2a330175af26","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:b4c1872bac4163c97ea296f6016526d75c1b9f68d312d37eb3916678d17c7d37","observation_id":"11f8678b-52ee-46bb-a237-a2a095868069","resolution":{"observed_at":"2026-05-11T23:36:14.616239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasonedit: Towards reasoning-enhanced image editing models","venue":null,"work_id":"2a9cd1b2-59ca-41bc-8893-507943c0ae84","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a74127ccac30916f8b90076697a4d732cab08371c07ccbf49dd76a39cecfabc3","observation_id":"0b79ee05-19de-4b75-9059-95910782387a","resolution":{"observed_at":"2026-05-27T01:53:22.710775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":"2505.05470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-07-09T02:25:55.898592Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","venue":"cs.CV","work_id":"bf1e8e81-ff31-401a-a5dc-d9c49df168ab","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:e408bc8a23c59778d8b3b6a2c1a7c1618a159d1bcd78d82270ce98d298a66242","observation_id":"b3c75896-eef1-4f10-a2cf-0c9328b07adc","resolution":{"observed_at":"2026-05-11T23:36:14.265384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":"2505.07818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-07-09T03:05:55.316091Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","venue":"cs.CV","work_id":"7404dd36-8f9c-478f-b089-ef9f8189c711","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:397c1ed2e745e540a3c587f84d1775d225e53c8ba16cc98c3d9d498a21215373","observation_id":"c25d9c85-cabc-4024-a324-d784b274e793","resolution":{"observed_at":"2026-05-11T23:36:14.547536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2021.3085339","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Text-guided human image manipulation via image-text shared space","venue":"IEEE Transactions on Pattern Analysis and Machine Intelligence","work_id":"ab7240a6-b179-4036-82f6-0d2dbcac055f","year":2022},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ac13d174f5956caeab8d61e82d7fba92272380783a727b92bcacf33d5aa6f687","observation_id":"64613d6a-9da2-4229-81cf-77bb937a4c28","resolution":{"observed_at":"2026-05-09T01:54:33.476823Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consistent image layout editing with diffusion models","venue":null,"work_id":"dcc69eb9-78a6-4658-ae44-85368ff64b85","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:c0e40adbad90364c024b0746fd161c91e12bb6d0ad53d7c9434fe9858ca0bb6f","observation_id":"6a5a6188-b894-4023-9c52-5bf9bb7e0c77","resolution":{"observed_at":"2026-05-27T01:53:22.729744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instruction-driven multi-weather image translation based on a large-scale image editing model","venue":null,"work_id":"dd44551b-208e-4206-ad57-46a97c99c326","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:06b30b5ad9e7460266223062a1f6f1e3f7242caba99b7e55daa568ba4d0ec468","observation_id":"b1e52f75-d346-4692-ae33-8a7dc5409961","resolution":{"observed_at":"2026-05-27T01:53:22.777501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spherical patch generative adversarial net for unconditional panoramic image generation","venue":null,"work_id":"76b4a2de-7ace-4ba7-91fc-40f8897cd9b7","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:69ac5b6b4298a443abc91c37df36a4de390004033b4076973de53b2e8d9c4ee6","observation_id":"df5b1cae-7ac9-4b93-85a4-596b0a45b8ec","resolution":{"observed_at":"2026-05-27T01:53:22.766814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2023.3347299","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Talk-to-edit: Fine-grained 2d and 3d facial editing via dialog","venue":"IEEE Transactions on Pattern Analysis and Machine Intelligence","work_id":"cf716b4d-ea03-4787-b5da-1964ccc4805f","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:51f9f799093fa07ecdc87050961f986a88ad73cb9bfd2d2dd8357ed5bebb22f8","observation_id":"e2488ebd-e723-465e-a624-17eb706f3741","resolution":{"observed_at":"2026-05-09T01:54:33.540347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixel-inconsistency modeling for image manipulation localization","venue":null,"work_id":"3c166248-d9c6-41ac-aa36-ab8f690a68ec","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a40a5ee214d327b60477590b6381514fa0563434fbb0fb049ea1637191f1d766","observation_id":"c55d235e-5357-4cbf-b99f-4d7a887201ad","resolution":{"observed_at":"2026-05-27T01:53:22.703325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2025.3541028","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Available: https://doi.org/10.1109/TPAMI.2025.3541028","venue":"IEEE Transactions on Pattern Analysis and Machine Intelligence","work_id":"c2a3341a-840d-45a5-9b0a-e1b4dfc9a78b","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:5db049d5e7cdb5ee1d3c138257c94fc207573b67e0bcf11aa160367e26e7a036","observation_id":"1c32b0bc-f36b-4399-bb2c-308a63bd4c8c","resolution":{"observed_at":"2026-05-09T01:54:33.324518Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12205","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:48:35.099664Z","title":"DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing","venue":null,"work_id":"a7e01e40-db36-42cf-bdd6-6e8b65a1ed0c","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:b7354cbb9744fbe0abf5b05ffd45bb9d6c559c8c25310e7b924e02959c1f6e7d","observation_id":"6b8c1c3e-7906-4516-854c-c5d66461ae70","resolution":{"observed_at":"2026-05-11T23:36:14.501643Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unit: Unified multimodal chain-of-thought test-time scaling","venue":null,"work_id":"654e3b6b-57f8-4961-9c9e-d9bb56962b98","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:5cc5143acee28e3b213df79d4f2979b4b3eb2d37970458c764c2d4069e010984","observation_id":"d8a0129d-69c8-44e9-8535-45921df8aa5c","resolution":{"observed_at":"2026-05-11T23:36:14.991572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.12252","last_updated":"2026-06-18T07:56:55Z","snapshot_observed_at":"2026-07-14T22:25:02.474086Z","submitted_at":"2026-03-12T17:58:48Z","title":"EndoCoT: Scaling Endogenous Chain-of-Thought Reasoning in Diffusion Models","version":4},"cited_work":{"arxiv_id":"2603.12252","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.12252","snapshot_observed_at":"2026-07-04T00:19:13.713508Z","title":"Endocot: Scaling endogenous chain-of-thought reasoning in diffusion models","venue":"cs.CV","work_id":"08ee73e4-1472-42c3-abac-1c18e9b0a642","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2603.12252","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:c7cbe484740ace69c4883b664291457d3a13e2521f7d10da80d920b892749ec7","observation_id":"fcd9db07-65e3-46c4-ad55-35d2c64da4f8","resolution":{"observed_at":"2026-06-19T17:11:33.200899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.01382","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:19:49.606655Z","title":"Promptrl: Prompt matters in rl for flow-based image generation","venue":null,"work_id":"4762b3e3-3543-475a-abb8-366e9d2e78bc","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:0a1329b99a63cc78f29ab4c39de0e9ecea0a2501c424cd461d3d3c3647da110a","observation_id":"b8c0d12c-b40a-44b2-b485-9237c2a35a49","resolution":{"observed_at":"2026-05-11T23:36:14.423005Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tip.2024.3364074","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Consensus- agent deep reinforcement learning for face aging","venue":"IEEE Transactions on Image Processing","work_id":"a8ebc433-4a29-4f7a-955e-e193cff95aeb","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:6ba7ba83950113bdde464c0679f09dcdb874d84592628f823a6125aff0c03767","observation_id":"5069e3b1-03fb-4cd7-ac4c-5045a2fe31c9","resolution":{"observed_at":"2026-05-09T01:54:33.505730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16864","last_updated":"2026-07-16T08:30:12Z","snapshot_observed_at":"2026-08-04T05:49:40.066717Z","submitted_at":"2025-12-18T18:34:23Z","title":"RePlan: Reasoning-guided Region Planning for Complex Instruction-based Image Editing","version":2},"cited_work":{"arxiv_id":"2512.16864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.16864","snapshot_observed_at":"2026-07-17T02:20:37.504540Z","title":"Replan: Reasoning-guided region planning for complex instruction-based image editing","venue":null,"work_id":"2ccea1c4-a4f0-41e0-bae9-07e0242e02e9","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2512.16864","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:eb6ee1d3dabe37646361cfde57cec97450300dfde8ddb719d4aaedc2075c9182","observation_id":"867a5b1b-9c61-49c5-b085-af5d8f4e8a46","resolution":{"observed_at":"2026-07-17T02:20:37.504540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02437","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T08:47:50.510363Z","title":"Unireason 1.0: A unified reasoning framework for world knowledge aligned image generation and editing","venue":null,"work_id":"78173501-4b1d-416b-bfcc-e61d472fcc3e","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:2db8fe6c9539193692d03ab43b0777c208c16d512ea44ebe58cfa4652c672036","observation_id":"3013bbfc-e023-45e3-bcf8-905ad6be7cf9","resolution":{"observed_at":"2026-05-11T23:36:14.295984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.10332","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:43:13.974516Z","title":"Think-then-generate: Reasoning-aware text-to-image diffusion with llm encoders","venue":null,"work_id":"7925fa6e-0d2a-4f77-b7d8-9ee2e9009b7f","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:06076c12f9914f2fae7417fc86858bcfd05893e8d80c576dae19ea2c990af366","observation_id":"a554675a-cfa5-4429-b558-f0de6edad0a5","resolution":{"observed_at":"2026-05-11T23:36:14.509617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Edit-r1: Unleashing reasoning-based reinforcement learning for image editing","venue":null,"work_id":"b2eed57f-b0bb-42bb-8879-475c3fac09c8","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:c23c2f74949a7e38ffbb4be18ca9035e5a1e3ed39e5c8347887e10cedba9351b","observation_id":"e21c94ba-54da-47bc-b5b6-1dc291e982b4","resolution":{"observed_at":"2026-05-27T01:53:22.714241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07265","last_updated":"2026-06-02T17:11:50Z","snapshot_observed_at":"2026-07-06T20:49:51.505079Z","submitted_at":"2025-03-10T12:47:53Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2503.07265","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07265","snapshot_observed_at":"2026-07-04T13:19:50.710913Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","venue":"cs.CV","work_id":"604c1ae0-368d-49bf-8117-d688ac59f305","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2503.07265","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:0f2f92ce976c95e468e0960152f90cb0a4d0ffae3bf209222885de44936b04fb","observation_id":"60500e0a-e98e-4cdb-bab1-659564550e67","resolution":{"observed_at":"2026-05-15T16:24:27.819650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialclip: Learning 3d-aware image representations from spatially discriminative language","venue":null,"work_id":"1a8d2c5a-b208-40f7-aab0-f9de8412f013","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:e8bcec89abee46d53a8a84b4e9f8d49a648090e58cc9db9c4ec8e79c20dfafbd","observation_id":"9cb1fd09-c8e8-422d-a062-c3282912cde1","resolution":{"observed_at":"2026-05-27T01:53:22.739413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21066","last_updated":"2025-08-28T17:59:46Z","snapshot_observed_at":"2026-08-05T14:39:40.988794Z","submitted_at":"2025-08-28T17:59:46Z","title":"OneReward: Unified Mask-Guided Image Generation via Multi-Task Human Preference Learning","version":1},"cited_work":{"arxiv_id":"2508.21066","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21066","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Onereward: Unified mask-guided image generation via multi-task human preference learning","venue":null,"work_id":"ae97244c-ffbd-4c00-82ee-89f3fdece7f4","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2508.21066","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:4974a075e50ec0ddd100c8680c6a1a7ef14fd78399c3a54b9be24963eda16c2e","observation_id":"dd654700-f1a2-4a2c-8b0c-cde4dba1cc01","resolution":{"observed_at":"2026-05-11T23:36:14.767670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tip.2023.3268001","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Describe, spot and explain: Interpretable representation learning for discriminative visual reasoning","venue":"IEEE Transactions on Image Processing","work_id":"3094cb0a-3f9e-4f32-b20f-497c853cb4f2","year":2023},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:7968cd37bb1d4d1e4ececc2082dc0492456b358768023068dd5109ecd423cbce","observation_id":"b31ef99a-4856-4ea1-9156-853034934313","resolution":{"observed_at":"2026-05-09T01:54:33.518102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23909","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.733583Z","title":"Editscore: Unlocking online rl for image editing via high-fidelity reward modeling","venue":null,"work_id":"478d04d3-d99b-4a09-b3b5-cc62c6528bf7","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:836d3651214bd803d0f70d70e7e7d9246b9202f2efe3e48e6a177f4dec45cd34","observation_id":"70a50361-b532-424a-bf54-9d9835b922f9","resolution":{"observed_at":"2026-05-11T23:36:14.389149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.26346","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.698229Z","title":"Editreward: A human- aligned reward model for instruction-guided image editing","venue":null,"work_id":"44f2e6b9-ba11-41a2-9c4f-aee7a3bc1178","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:12e26826978fc56944be2bae23706a9613a5465eff25e1f2102afd3957fc1470","observation_id":"3868c4d7-7de3-46c5-9218-3dfcd9f085f1","resolution":{"observed_at":"2026-05-11T23:36:14.458415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decompose and compare consistency: Measuring vlms’ answer reliability via task-decomposition consistency comparison","venue":null,"work_id":"0814c2d4-e341-4156-988b-0ec83ed62d00","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:343e7f2f05149cc38ffbea9f173b1b20e8736c7da56f9248f49c123256e4cb23","observation_id":"e9f2bb27-9ede-4220-9e40-7ad7c4d29650","resolution":{"observed_at":"2026-05-27T01:53:22.717723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A minimalist approach to llm reasoning: from rejection sampling to reinforce","venue":null,"work_id":"c27210b4-01a1-431a-82d2-45889f0a4666","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:7b3aed54863621f7ae9346ac78ff3ac2c5e72c5c8c335f8fb07ed388ae3a5c04","observation_id":"8cc3be6f-688a-4af2-a6da-c2c03df58f84","resolution":{"observed_at":"2026-05-27T01:53:22.745853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Star-ds: Step-level uncertainty-aware reasoning data selection in reinforcement learning for llm multi-step reasoning","venue":null,"work_id":"42fc31f9-55f6-4a37-899f-12cd2a573151","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:3f170f4d25dfa6374aaf3d1cd75cba0d87896074be06526dca6903efdc7a290d","observation_id":"13fbd3b2-276d-40d2-a930-0b52616a2d80","resolution":{"observed_at":"2026-05-27T01:53:22.706888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":"6ec92951-d157-4d42-a138-ac6e09e7509c","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ef8464804e4380d99dc74d128201f701e9244169e52040de7949288dc5e62503","observation_id":"ba05cc04-9a67-48db-bad7-3ebdac4a083f","resolution":{"observed_at":"2026-05-27T01:53:22.721277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative multimodal models are in-context learners","venue":null,"work_id":"04c28a82-8f82-43e0-bfc3-171b9f324d13","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a1ab717796424de70e467ca42564d9f4fce871b157623da2a10a32accd3a6a6d","observation_id":"df859c47-4841-44d5-bc39-21db35dd212c","resolution":{"observed_at":"2026-05-27T01:53:22.735789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnigen: Unified image generation","venue":null,"work_id":"1728e796-5294-4f8d-a4dc-d74e28b5d779","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:1c21052834639f2647963d081f828c1920efc8f3036a97dd268ed502ee010d41","observation_id":"e2e9b417-bf7c-4baa-88d4-7b6fc997eee4","resolution":{"observed_at":"2026-05-27T01:53:22.749137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20797","last_updated":"2024-06-17T17:51:50Z","snapshot_observed_at":"2026-07-06T18:23:15.098065Z","submitted_at":"2024-05-31T13:59:18Z","title":"Ovis: Structural Embedding Alignment for Multimodal Large Language Model","version":2},"cited_work":{"arxiv_id":"2405.20797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20797","snapshot_observed_at":"2026-07-04T19:50:10.268440Z","title":"Ovis: Structural embedding alignment for multimodal large language model","venue":null,"work_id":"6f4025f6-a13c-4549-b0dc-8f2bb5a5a954","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2405.20797","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:1fb04448b76cb9b674067dec39631520a0aa6f36ab0dec4fddf7b9f2d4c8120f","observation_id":"a6b4084a-6e5c-4be7-b4d8-b60f0d7ccc78","resolution":{"observed_at":"2026-05-11T23:36:14.874224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:967da7bc2635f28e3f9b3b0fa5755599e773d5409f07a8055fe82bfcfe4721b8","observation_id":"6aca301e-b303-4904-b415-24b450a7d9eb","resolution":{"observed_at":"2026-05-11T23:36:14.448393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.05606","doi":"10.48550/arxiv.2508.05606","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Uni-cot: Towards unified chain-of-thought reasoning across text and vision.arXiv preprint arXiv:2508.05606","venue":"arXiv (Cornell University)","work_id":"2d7c3351-90a7-45ce-a374-890c71fbea6e","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:18f5409a7a90824eba376f794b5d57096484e914ae25514645d57a1b780a5a9a","observation_id":"af292168-a3a3-45c9-870e-4093f538a5f4","resolution":{"observed_at":"2026-05-11T23:36:14.339354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing","venue":null,"work_id":"1dcacaad-c802-4572-9fdd-bf47346505de","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:fd04d8a17846ad25ef3325159b9c6f45475c2410174b98a9cd985dae7346add2","observation_id":"fbbc63a1-53f6-4066-b9cd-f6e3dd5593ea","resolution":{"observed_at":"2026-05-27T01:53:22.756741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anyedit: Mastering unified high-quality image editing for any idea","venue":null,"work_id":"2acfbdd6-92cb-4eb3-9e49-46b8eb6e7637","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:003d4617b72e77827310c1fe93e3df61c944b0f2d73145159c08c804942c3845","observation_id":"a4a839c6-1044-4bb1-a390-b194736c4edc","resolution":{"observed_at":"2026-05-27T01:53:22.763254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22705","last_updated":"2025-05-28T17:59:15Z","snapshot_observed_at":"2026-07-30T00:45:52.058972Z","submitted_at":"2025-05-28T17:59:15Z","title":"HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2505.22705","doi":"10.48550/arxiv.2505.22705","metadata_source":"pith","pith_arxiv_id":"2505.22705","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer","venue":"cs.CV","work_id":"68d4c0f7-3dfd-438d-a823-6a93fd0a835d","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.22705","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:befe258a0531b8e553396a658972f732ea0a8f0b54cbb782fc7f369c8f87234b","observation_id":"555a3239-68b4-41bd-8c0e-c1a7bc3856e1","resolution":{"observed_at":"2026-05-16T17:13:39.137651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03107","last_updated":"2025-06-11T06:11:36Z","snapshot_observed_at":"2026-07-06T21:35:56.582332Z","submitted_at":"2025-06-03T17:39:47Z","title":"ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions","version":2},"cited_work":{"arxiv_id":"2506.03107","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03107","snapshot_observed_at":"2026-07-04T00:09:13.963661Z","title":"Bytemorph: Benchmarking instruction- guided image editing with non-rigid motions.ArXiv, abs/2506.03107","venue":null,"work_id":"8729a5f7-a8aa-43f1-8724-d77948f05226","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2506.03107","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:86d3b6ba8a2b6ef5e2f16e50e94b519814cca44d093d0329b8fe9b95cee1cf1e","observation_id":"cc3ba391-0e60-4e04-8d7c-82b41e592fad","resolution":{"observed_at":"2026-05-11T23:36:14.376218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":"2506.18871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-07-10T01:46:41.215139Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","venue":"cs.CV","work_id":"d3153e5f-b6e2-4ab3-9f41-e24e24d64496","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:e44093d8cdaac5efe093006792ca2ed0ef36a6cedc381a1185fc758ce7603ab0","observation_id":"ee52f3b7-b9ad-4781-99ba-833876aff080","resolution":{"observed_at":"2026-05-11T23:36:15.095575Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03147","last_updated":"2025-06-18T18:00:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-03T17:59:33Z","title":"UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation","version":4},"cited_work":{"arxiv_id":"2506.03147","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03147","snapshot_observed_at":"2026-07-05T16:51:14.197597Z","title":"UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation","venue":"cs.CV","work_id":"488a273e-95d8-46f1-87c7-2244068d00d0","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2506.03147","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:d2cc7bb7a0bd33e051226399b0da7b7bc4de7d81d17138005c8c916682ddcb5e","observation_id":"903d680e-eb14-4211-995c-f28a796fab80","resolution":{"observed_at":"2026-05-12T17:34:27.304691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3-vl technical report","venue":null,"work_id":"c32ad150-c66e-4c44-8ced-f7760469274c","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ab3cfad6fe7e19aee20f2aaa024b8e360e005afabea04e09af3025bb560a34f2","observation_id":"3cd9d8c5-c127-464c-8674-8b05fbce0139","resolution":{"observed_at":"2026-05-27T01:53:22.781074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-07-06T21:28:33.821060Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:17d3dcc3dc9e41131a130ce4145b48526c4fc34e81f7cd55110e85f885a3ea50","observation_id":"985954a5-013f-4361-bb59-b5aa280e606d","resolution":{"observed_at":"2026-05-11T23:36:14.561125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":40,"verified_fuzzy":23},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2604.25477."}