{"as_of":"2026-08-08T18:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:279c0914d5304b85f2f1a651b693b5c4b8107277e629c02c8186593e4bbe25f6","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T20:38:29.644968Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:41:10.852265Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:19:50.703399Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"cited_work":{"arxiv_id":"2602.22809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22809","snapshot_observed_at":"2026-07-17T02:20:40.282302Z","title":"PhotoAgent: Agentic photo editing with exploratory visual aesthetic planning","venue":null,"work_id":"ef37c372-cd0f-4bae-81fa-6e916d66b680","year":2026},"citing_paper":{"arxiv_id":"2604.02409","last_updated":"2026-04-02T17:58:05Z","snapshot_observed_at":"2026-07-31T00:51:14.682453Z","submitted_at":"2026-04-02T17:58:05Z","title":"LumiVideo: An Intelligent Agentic System for Video Color Grading","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T21:36:49.074380Z"},"links":{"cited_paper":"/paper/2602.22809","citing_paper":"/paper/2604.02409"},"observation_digest":"sha256:4a142d48ed1c09aad1144e2664b16338db4c506792aba2e454655d2a68c423d8","observation_id":"4fdbf816-71be-48e3-904d-c1e50e94999f","resolution":{"observed_at":"2026-07-17T02:20:40.282302Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"cited_work":{"arxiv_id":"2602.22809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22809","snapshot_observed_at":"2026-07-17T02:20:40.282302Z","title":"PhotoAgent: Agentic photo editing with exploratory visual aesthetic planning","venue":null,"work_id":"ef37c372-cd0f-4bae-81fa-6e916d66b680","year":2026},"citing_paper":{"arxiv_id":"2604.03400","last_updated":"2026-04-03T19:01:33Z","snapshot_observed_at":"2026-08-02T11:06:20.837347Z","submitted_at":"2026-04-03T19:01:33Z","title":"Banana100: Breaking NR-IQA Metrics by 100 Iterative Image Replications with Nano Banana Pro","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T20:18:42.018970Z"},"links":{"cited_paper":"/paper/2602.22809","citing_paper":"/paper/2604.03400"},"observation_digest":"sha256:b1d8cea7d2eb40441707022d3612797f67d4e603be138b87dc845382ff8789d8","observation_id":"1192b081-af2e-4236-b932-902c569914ff","resolution":{"observed_at":"2026-07-17T02:20:40.282302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"cited_work":{"arxiv_id":"2602.22809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22809","snapshot_observed_at":"2026-07-17T02:20:40.282302Z","title":"PhotoAgent: Agentic photo editing with exploratory visual aesthetic planning","venue":null,"work_id":"ef37c372-cd0f-4bae-81fa-6e916d66b680","year":2026},"citing_paper":{"arxiv_id":"2604.19587","last_updated":"2026-04-21T15:38:49Z","snapshot_observed_at":"2026-08-03T01:32:14.204319Z","submitted_at":"2026-04-21T15:38:49Z","title":"SmartPhotoCrafter: Unified Reasoning, Generation and Optimization for Automatic Photographic Image Editing","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T02:10:12.484462Z"},"links":{"cited_paper":"/paper/2602.22809","citing_paper":"/paper/2604.19587"},"observation_digest":"sha256:47acd2bb8ddb875585fee6c181ad031e91fff3d1be29acff046ebdf2c2a41a77","observation_id":"4c124d8c-2a10-40df-9b6d-daa8aee6e6e2","resolution":{"observed_at":"2026-07-17T02:20:40.282302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"cited_work":{"arxiv_id":"2602.22809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22809","snapshot_observed_at":"2026-07-17T02:20:40.282302Z","title":"PhotoAgent: Agentic photo editing with exploratory visual aesthetic planning","venue":null,"work_id":"ef37c372-cd0f-4bae-81fa-6e916d66b680","year":2026},"citing_paper":{"arxiv_id":"2605.14842","last_updated":"2026-05-14T13:46:24Z","snapshot_observed_at":"2026-08-06T21:38:07.402815Z","submitted_at":"2026-05-14T13:46:24Z","title":"Editor's Choice: Evaluating Abstract Intent in Image Editing through Atomic Entity Analysis","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-30T21:41:10.852265Z"},"links":{"cited_paper":"/paper/2602.22809","citing_paper":"/paper/2605.14842"},"observation_digest":"sha256:bc9b619392f35cb88fc178aa304551c783dc5a82998210084e289e4574a4afba","observation_id":"75bf9dd2-b566-4487-9838-7d9c86bce491","resolution":{"observed_at":"2026-07-17T02:20:40.282302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"cited_work":{"arxiv_id":"2602.22809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22809","snapshot_observed_at":"2026-07-17T02:20:40.282302Z","title":"PhotoAgent: Agentic photo editing with exploratory visual aesthetic planning","venue":null,"work_id":"ef37c372-cd0f-4bae-81fa-6e916d66b680","year":2026},"citing_paper":{"arxiv_id":"2605.18748","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-08-02T06:15:05.492636Z","submitted_at":"2026-05-18T17:59:03Z","title":"Aurora: Unified Video Editing with a Tool-Using Agent","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T10:47:05.038308Z"},"links":{"cited_paper":"/paper/2602.22809","citing_paper":"/paper/2605.18748"},"observation_digest":"sha256:f17e8fd15776b74bc1353e3bf045f9811e07cbb5fe41e55e3e88899728a420b3","observation_id":"941ccd5a-e734-42dd-a537-b206a09f4703","resolution":{"observed_at":"2026-07-17T02:20:40.282302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"cited_work":{"arxiv_id":"2602.22809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22809","snapshot_observed_at":"2026-07-17T02:20:40.282302Z","title":"PhotoAgent: Agentic photo editing with exploratory visual aesthetic planning","venue":null,"work_id":"ef37c372-cd0f-4bae-81fa-6e916d66b680","year":2026},"citing_paper":{"arxiv_id":"2606.26907","last_updated":"2026-06-26T14:10:09Z","snapshot_observed_at":"2026-08-07T03:18:39.904639Z","submitted_at":"2026-06-25T11:40:12Z","title":"Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T05:19:21.433049Z"},"links":{"cited_paper":"/paper/2602.22809","citing_paper":"/paper/2606.26907"},"observation_digest":"sha256:8f2c263a2db943afe89f6e23513949da320f35efa18357f00939dc0c95c62a33","observation_id":"6263acd8-b4cf-47ad-bedd-630a9f408f0c","resolution":{"observed_at":"2026-07-17T02:20:40.282302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"cited_work":{"arxiv_id":"2602.22809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22809","snapshot_observed_at":"2026-07-17T02:20:40.282302Z","title":"PhotoAgent: Agentic photo editing with exploratory visual aesthetic planning","venue":null,"work_id":"ef37c372-cd0f-4bae-81fa-6e916d66b680","year":2026},"citing_paper":{"arxiv_id":"2606.26907","last_updated":"2026-06-26T14:10:09Z","snapshot_observed_at":"2026-08-07T03:18:39.904639Z","submitted_at":"2026-06-25T11:40:12Z","title":"Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T04:58:40.065005Z"},"links":{"cited_paper":"/paper/2602.22809","citing_paper":"/paper/2606.26907"},"observation_digest":"sha256:7ee9c5c3263cc5ccadb8f7e4ffcb1d185f56a8d9daa011519fe0ad0a0b647932","observation_id":"be0df288-8309-4bef-bd60-a04c304bf020","resolution":{"observed_at":"2026-07-17T02:20:40.282302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.22809/citation-record","integrity":"/paper/2602.22809/integrity","json":"/paper/2602.22809/citation-record.json","paper":"/paper/2602.22809"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:23.382295Z","title":"Stable diffusion 3.5.https : / / huggingface","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:23.382295Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:35d5530542a2ff802031a8ee1e11f024ec148328ed7c91beca6710b8a79ef1b6","observation_id":"53f9fc35-55e7-4ad5-bb42-f1651e5e9c54","resolution":{"observed_at":"2026-08-02T20:38:23.382295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-02T20:38:23.446746Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:23.446746Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:10f47bc8e131f64de6d5ad3f921e948cf7d9dab397aec0d7e27f6cb93b9bd17b","observation_id":"20d0d4a4-2c64-4f7d-8f5d-5fd0ad7a898a","resolution":{"observed_at":"2026-08-02T20:38:23.446746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T20:38:23.588388Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:23.588388Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:00272264c779aa0f5d2f3479808cbe335048a843df3e257ec7f2fe47f6c0c338","observation_id":"30b30030-7a4b-44e6-b057-004021798d21","resolution":{"observed_at":"2026-08-02T20:38:23.588388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:23.751562Z","title":"The opencv library.Dr","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:23.751562Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:f890d65054f19fa14dfbcba29a0b5673982c1aae781bcb83c2865352c3898034","observation_id":"419b8994-f123-4608-bd4e-146c11df0c96","resolution":{"observed_at":"2026-08-02T20:38:23.751562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:23.847299Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:23.847299Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:62cfa49e9499fe2ccc9c1007c6b12b1861fbf560a940513990656acc12febd89","observation_id":"8273bab9-3441-47ee-8757-e18fc590214b","resolution":{"observed_at":"2026-08-02T20:38:23.847299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:23.961086Z","title":"A survey of monte carlo tree search methods","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:23.961086Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:23b007d2baceee3c621f522f44fb1e0b4becb16b27df4f86ac00af16227e5f73","observation_id":"1a3f3b3c-8b92-40e4-b122-50663e48d083","resolution":{"observed_at":"2026-08-02T20:38:23.961086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23951","last_updated":"2026-06-26T07:53:46Z","snapshot_observed_at":"2026-08-04T14:42:12.962842Z","submitted_at":"2025-09-28T16:14:10Z","title":"HunyuanImage 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23951","snapshot_observed_at":"2026-08-02T20:38:24.072581Z","title":"Hunyuanimage 3.0 technical report.arXiv preprint arXiv:2509.23951, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.072581Z"},"links":{"cited_paper":"/paper/2509.23951","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:e0aed914cb15e48889ef31c4855fe3f85960cb7d8b1762999595d277008b8e98","observation_id":"717fb44a-2a4f-4740-9ab4-397871c13474","resolution":{"observed_at":"2026-08-02T20:38:24.072581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:24.201091Z","title":"Monte-carlo tree search: A new framework for game ai","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.201091Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:7476adf0096f545416ee8e78d11fb2c8a3bdb50bac1a05f0bf6d953876535131","observation_id":"18d2283a-13ce-4a6d-b637-c0316737d449","resolution":{"observed_at":"2026-08-02T20:38:24.201091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23130","last_updated":"2025-05-29T06:00:51Z","snapshot_observed_at":"2026-08-07T12:50:29.281980Z","submitted_at":"2025-05-29T06:00:51Z","title":"PhotoArtAgent: Intelligent Photo Retouching with Language Model-Based Artist Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23130","snapshot_observed_at":"2026-08-02T20:38:24.354000Z","title":"Photoartagent: Intelligent photo retouch- ing with language model-based artist agents.arXiv preprint arXiv:2505.23130, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.354000Z"},"links":{"cited_paper":"/paper/2505.23130","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:85a9fe0013fc0127a734a5446057e5edde73b31890ddcb35f4edaebc35cc649b","observation_id":"40b90d74-b4a5-4d47-a18d-6ce483ce7018","resolution":{"observed_at":"2026-08-02T20:38:24.354000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:24.459288Z","title":"Edival-agent: An object-centric frame- work for automated, fine-grained evaluation of multi-turn editing.arXiv preprint arXiv:2509.13399, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.459288Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:1865b29f1db2fa2f45d55d631b0e1ccc6eca0a98d9d719c987443ff48a0c45ed","observation_id":"9d74a637-2e2a-4e09-b6fe-5f8140073099","resolution":{"observed_at":"2026-08-02T20:38:24.459288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:24.582286Z","title":"Stargan: Unified genera- tive adversarial networks for multi-domain image-to-image translation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.582286Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:cd9513fe92cf53e254985db71391270bfbb17fa1733bb8a612fe6903928d2059","observation_id":"5c55fb7b-92f7-4696-afff-718f747ccaf6","resolution":{"observed_at":"2026-08-02T20:38:24.582286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:24.677102Z","title":"Instruc- tir: High-quality image restoration following human instruc- tions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.677102Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:e30f4775fa8621dff70e522de6427ac41189176fa92e1c14c0e3db3e8675d3a5","observation_id":"e274cc33-9ab5-4cb8-abbe-62a7012a2b22","resolution":{"observed_at":"2026-08-02T20:38:24.677102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-02T20:38:24.809578Z","title":"Emerging properties in unified multimodal pretraining.arXiv preprint arXiv:2505.14683, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.809578Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:46db307ae344e092abd61c39f3abb94d8df4349f794878b6910254acf9dc801c","observation_id":"692db641-df41-44b6-a5ef-a1ad76e8180f","resolution":{"observed_at":"2026-08-02T20:38:24.809578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:24.978814Z","title":"Aesthetic predictor v2.5: Siglip-based aes- thetic score predictor.https : / / github","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:24.978814Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:96ef4aeb9b8dbcaa2e827e0692218f1a58958754f6bed46922b58e8e3f2753f4","observation_id":"ad1887e0-38f6-4046-8e62-245ba70acc48","resolution":{"observed_at":"2026-08-02T20:38:24.978814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:25.058091Z","title":"Monetgpt: Solving puzzles enhances mllms’ image retouch- ing skills.ACM Transactions on Graphics (TOG), 44(4):1– 12, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:25.058091Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:26a0ecae79b51185a66acd834e9b878f0113d04fcd3ef983c9c7a0cdd648834e","observation_id":"c78bd259-670a-44c4-af21-1a21531562a8","resolution":{"observed_at":"2026-08-02T20:38:25.058091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:25.253280Z","title":"Goodfellow, Jean Pouget-Abadie, Mehdi Mirza, Bing Xu, David Warde-Farley, Sherjil Ozair, Aaron Courville, and Yoshua Bengio","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:25.253280Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:64c1ea0d32e020b120fe0a33757cf61752c8eba3f041caf3f2f204b6b379241b","observation_id":"1658b60e-3c61-4822-85ec-33c4cdf3f721","resolution":{"observed_at":"2026-08-02T20:38:25.253280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:25.363368Z","title":"Nano banana: Gemini 2.5 flash image editing model.https://aistudio.google.com/models/ gemini-2-5-flash-image, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:25.363368Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:9d7b8f76c01cf4ab8444e0e62f16f75ed53668db2f1854b066fc60360c63b62f","observation_id":"15ea4fb9-c01a-41e4-83cb-47a55f03ec38","resolution":{"observed_at":"2026-08-02T20:38:25.363368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-02T20:38:25.451965Z","title":"Prompt-to-prompt im- age editing with cross attention control.arXiv preprint arXiv:2208.01626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:25.451965Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:4c3a7d702609b08613f2217ab70576ced473844b6d210e17db5c339bf71999b2","observation_id":"651e4b9c-5a9c-4d21-95d2-42c6d841353f","resolution":{"observed_at":"2026-08-02T20:38:25.451965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:25.639958Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:25.639958Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:011602062b7bc1fc7c02be4e15fa49d76a1439eef2c92ca0888aa1c8afab8b8a","observation_id":"e75b2225-afeb-4b24-8114-366935e76ab3","resolution":{"observed_at":"2026-08-02T20:38:25.639958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:25.795871Z","title":"Flux.1 kontext: Flow matching for in-context image generation and editing in latent space,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:25.795871Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:70515f9ce5151d73ecd990f9e6e70e14c35d41e5cb042bf5b1993a63566adf4c","observation_id":"afb28df8-768e-4ea4-a57b-f22ea0d03cd3","resolution":{"observed_at":"2026-08-02T20:38:25.795871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06141","last_updated":"2025-03-08T09:49:10Z","snapshot_observed_at":"2026-08-07T17:20:26.966993Z","submitted_at":"2025-03-08T09:49:10Z","title":"Next Token Is Enough: Realistic Image Quality and Aesthetic Scoring with Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06141","snapshot_observed_at":"2026-08-02T20:38:25.905134Z","title":"Next token is enough: Realistic image quality and aesthetic scoring with multimodal large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:25.905134Z"},"links":{"cited_paper":"/paper/2503.06141","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:845ce871362b0e3ecd1f8aed7d877d61185038e50583f0c2907b6469a3c406b7","observation_id":"54e7f1db-24bb-498c-b506-ecb56635e678","resolution":{"observed_at":"2026-08-02T20:38:25.905134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17612","last_updated":"2025-06-21T06:36:00Z","snapshot_observed_at":"2026-08-06T23:28:12.134022Z","submitted_at":"2025-06-21T06:36:00Z","title":"JarvisArt: Liberating Human Artistic Creativity via an Intelligent Photo Retouching Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17612","snapshot_observed_at":"2026-08-02T20:38:26.029473Z","title":"Jarvisart: Liberating human artistic creativ- ity via an intelligent photo retouching agent.arXiv preprint arXiv:2506.17612, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.029473Z"},"links":{"cited_paper":"/paper/2506.17612","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:ed2feec35c363b4266e308b95778987db5579397dbf276730886c7ad0f943959","observation_id":"75858d43-b698-4e79-a41b-99812e932bf2","resolution":{"observed_at":"2026-08-02T20:38:26.029473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:26.144966Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.144966Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:b9d59cb33f88c4f6ffaa944b731f4bec910e86c003a9cdf2b0b373ac1a50edba","observation_id":"a6dce996-5a04-4e98-bfa9-933fdf8282cf","resolution":{"observed_at":"2026-08-02T20:38:26.144966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-02T20:38:26.324566Z","title":"Step1x-edit: A practical framework for gen- eral image editing.arXiv preprint arXiv:2504.17761, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.324566Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:d371e1fbac7651e2101aaf9b5041e933b3e051ec2ee79b165fd408ee1c852402","observation_id":"822b8532-b02a-4fc4-9c18-62429a1a67f2","resolution":{"observed_at":"2026-08-02T20:38:26.324566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:26.450891Z","title":"No-reference image quality assessment in the spatial domain.IEEE Transactions on image processing, 21(12):4695–4708, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.450891Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:f1598f0b6d559173c2f99825af2f73473a489e11f4ff727f8762a3178bd3536f","observation_id":"17d584a5-fefb-4ca5-b37e-8ff19475cda8","resolution":{"observed_at":"2026-08-02T20:38:26.450891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:26.622627Z","title":"completely blind","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.622627Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:bf5683dd2c4c7e9b0e976bcbf800ae82dc73e423873928e1567d000e174ebfc0","observation_id":"b1978abc-4e7d-439d-bf74-a91e68694104","resolution":{"observed_at":"2026-08-02T20:38:26.622627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:26.733437Z","title":"Nvidia developer blog.https:// developer.nvidia.com/blog","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.733437Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:ab67ca4996b3595d7d608331a3dc21f548741d7313ce2d972d3aec158d917387","observation_id":"95ed3eb1-e824-45ef-90a3-ab35db3f2b00","resolution":{"observed_at":"2026-08-02T20:38:26.733437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:26.840670Z","title":"Dall·e 3, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.840670Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:0de04f64b908702461693a4b7667b7e0c4fc285cc762002a6b3727bad5946039","observation_id":"23ee280d-ab7a-4ad1-9aa0-24e0da5f1acb","resolution":{"observed_at":"2026-08-02T20:38:26.840670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:26.986735Z","title":"Gpt-4o.https://openai.com/index/ hello-gpt-4o, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:26.986735Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:fa749ed45171bdc1f9c8822a476ee4717048ad24cf19021bb69d04cc438a5c1b","observation_id":"f9d8243b-135a-4c51-835d-aad5a7fb5632","resolution":{"observed_at":"2026-08-02T20:38:26.986735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-02T20:38:27.162241Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.162241Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:7101d6f62d00c9ecce55815c38337edead8fe0e3bf242b1426babc6ef9aefb6d","observation_id":"1320aba5-9235-4995-b14b-3a4191077665","resolution":{"observed_at":"2026-08-02T20:38:27.162241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:27.304988Z","title":"Promptir: Prompting for all-in- one image restoration.Advances in Neural Information Pro- cessing Systems, 36:71275–71293, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.304988Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:6eaec315b8e727524386c98070da6379738b95185497b016670a546fa67fdd15","observation_id":"5917387e-7640-42bb-b835-4bf61abd2051","resolution":{"observed_at":"2026-08-02T20:38:27.304988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-02T20:38:27.408216Z","title":"Learn- ing transferable visual models from natural language super- vision.arXiv preprint arXiv:2103.00020, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.408216Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:d9a8cdb3b9112deeac0add2de9cd809daf2e9c2044e266f8ff34136a505cdcb6","observation_id":"e16c86de-d160-411f-a342-c66f90764cd0","resolution":{"observed_at":"2026-08-02T20:38:27.408216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:27.573416Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.573416Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:b067fdaed3082085a5b7f0abdf1926e03f524a18c2be132c71c6db9dabf05177","observation_id":"68f7fe8e-2c93-46bf-a47f-4eb494065101","resolution":{"observed_at":"2026-08-02T20:38:27.573416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:27.663654Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models.Advances in neural in- formation processing systems, 35:25278–25294, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.663654Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:da88c204537fa3b67d29c7c5a0bb39dcd99148c7ba15c35e916dbf634f96cbee","observation_id":"088f388e-3870-436e-bd77-6f44ab51d287","resolution":{"observed_at":"2026-08-02T20:38:27.663654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T20:38:27.768945Z","title":"Deepseekmath: Pushing the limits of math- ematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.768945Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:7930716abeb1d0d0cf0c083f96c3e91a82f7de402c4260f74b2e6bf5487a2025","observation_id":"c12267df-f169-439e-9c3e-525f412baba7","resolution":{"observed_at":"2026-08-02T20:38:27.768945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:27.874327Z","title":"Hugginggpt: Solving ai tasks with chatgpt and its friends in hugging face.Advances in Neural Information Processing Systems, 36:38154–38180,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.874327Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:280d50229fc0b0462e1664d26ae3f4caddf0eb0ba0a7d26bed2e4eb41c63a356","observation_id":"51104d37-d1ae-4bfd-8f06-330f4bc53e19","resolution":{"observed_at":"2026-08-02T20:38:27.874327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:27.957066Z","title":"Animaker: Automated multi-agent animated storytelling with mcts-driven clip generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:27.957066Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:3ddb17d7db7ff3c0ddbe796356e7e9ae0eac9894d7e50452fc94a0de8e28de31","observation_id":"738085e1-b8f5-4e27-9429-4387465f939f","resolution":{"observed_at":"2026-08-02T20:38:27.957066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:28.062091Z","title":"Mastering the game of go with deep neu- ral networks and tree search.Nature, 529(7587):484–489,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.062091Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:f5d38a44923a8e4f571e45fe1970957edc63fed31f7481ae16fe53a947f3586f","observation_id":"235ffcb0-bac5-4c0c-9371-f2109dd0fac4","resolution":{"observed_at":"2026-08-02T20:38:28.062091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-02T20:38:28.196103Z","title":"V oyager: An open-ended embodied agent with large language models.arXiv preprint arXiv: Arxiv-2305.16291,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.196103Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:a482a0d33e656df9f35f22c21d2f784ac3fe0cd37429f701e6f1c0ca4b8a57cf","observation_id":"a16f439d-ba6b-42e8-a568-e058e7dccf5b","resolution":{"observed_at":"2026-08-02T20:38:28.196103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-02T20:38:28.355182Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.355182Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:c8ec92714c54eb18c257b53419c7141b3b8ed78a30f269bf9711d61148764509","observation_id":"688aae9b-4947-46cf-a33d-63931e68265b","resolution":{"observed_at":"2026-08-02T20:38:28.355182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:28.471685Z","title":"Image quality assessment: From error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.471685Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:e5cae44dec9773ae9795651de663fcd24f987fcebfba6dee0de523ee02638c43","observation_id":"a57d2a22-ab28-46e4-b3d7-9f23e7beb19b","resolution":{"observed_at":"2026-08-02T20:38:28.471685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:28.588715Z","title":"Genartist: Multimodal llm as an agent for unified image gen- eration and editing.Advances in Neural Information Pro- cessing Systems, 37:128374–128395, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.588715Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:87451d7a2f2d3ca6c66db6dd56018e3a8ad848bb953f1f6a7d2d3e32da569015","observation_id":"88d7d8bd-0c6c-4ad8-9b6a-f960b8aea68c","resolution":{"observed_at":"2026-08-02T20:38:28.588715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:28.742698Z","title":"Qwen-image technical report,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.742698Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:f3f01bc0f4383b682376e18b80f5e4fb24a4c918874928871931fedfed9a05f1","observation_id":"1d86da36-1a33-4ae4-abac-cb6cea2bc380","resolution":{"observed_at":"2026-08-02T20:38:28.742698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-02T20:38:28.844477Z","title":"Show-o: One single transformer to unify multimodal understanding and generation.arXiv preprint arXiv:2408.12528, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.844477Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:38f74dbc7e968e72a64dab13391966c83f66c63b2c84fbad6277d79e7725a042","observation_id":"2e9cf468-1ace-44ec-8885-f4f704743137","resolution":{"observed_at":"2026-08-02T20:38:28.844477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:28.947635Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation.Advances in Neural Information Pro- 10 cessing Systems, 36:15903–15935, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:28.947635Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:e287e2e13f5746112483e3a45ecc5999c5b05d26666940dd425465bdc48fde2d","observation_id":"6040e42e-c1b9-46c3-af37-c78350e9cf1a","resolution":{"observed_at":"2026-08-02T20:38:28.947635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:29.041012Z","title":"Personalized image aes- thetics assessment with rich attributes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:29.041012Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:39f4cfad949ca1e1ffed69380730893ae7f033ab488a2b3364149258344f428d","observation_id":"3c5f8fcb-9a4a-4599-99e6-dcc0e39f842c","resolution":{"observed_at":"2026-08-02T20:38:29.041012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:29.174464Z","title":"ReAct: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:29.174464Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:a0451ae0034dffc9760f71625cf0b0498061e4c7e931e938fab57029bcec99a7","observation_id":"b54586c2-17ba-4c52-9195-791724ff7af1","resolution":{"observed_at":"2026-08-02T20:38:29.174464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:29.265939Z","title":"Agent banana: High-fidelity image editing with agentic thinking and tooling.arXiv preprint arXiv:2602.09084, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:29.265939Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:7e7f3d7ec07a93b09a34c5e9cd84b302859f0ff67bb2db7b69961faf48b52040","observation_id":"4e5fdfa5-46b9-4037-8555-daeb214f6531","resolution":{"observed_at":"2026-08-02T20:38:29.265939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:29.377944Z","title":"Personalized image aes- thetics assessment with attribute-guided fine-grained feature representation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:29.377944Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:75b8ea764b68d0ea365ce5fb1135baa2024419cac5ef98a09e897e9c4719fc71","observation_id":"ba7db46f-8907-499c-9bc4-b6fef297edc6","resolution":{"observed_at":"2026-08-02T20:38:29.377944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:38:29.498769Z","title":"Unpaired image-to-image translation using cycle- consistent adversarial networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:29.498769Z"},"links":{"citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:da42fb2f5dfa740baddad7b8cd24bb7ee19f7c4eac1fbcc168c05867386fc69a","observation_id":"48640e3a-8a5a-4e8c-abc2-baad22a6e4f0","resolution":{"observed_at":"2026-08-02T20:38:29.498769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07105","last_updated":"2025-07-09T17:59:19Z","snapshot_observed_at":"2026-08-06T18:45:00.927874Z","submitted_at":"2025-07-09T17:59:19Z","title":"4KAgent: Agentic Any Image to 4K Super-Resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07105","snapshot_observed_at":"2026-08-02T20:38:29.644968Z","title":"4kagent: agentic any image to 4k super- resolution.arXiv preprint arXiv:2507.07105, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T20:38:29.644968Z"},"links":{"cited_paper":"/paper/2507.07105","citing_paper":"/paper/2602.22809"},"observation_digest":"sha256:627dce87578f656b99f7ad910d637446dc4312ce177d1c70f6d0458fa918c66f","observation_id":"fa2bad7f-d794-4510-9110-3de780d46d94","resolution":{"observed_at":"2026-08-02T20:38:29.644968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.22809","last_updated":"2026-07-16T09:58:43Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T20:32:37.167622Z","submitted_at":"2026-02-26T09:46:06Z","title":"PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision Models"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 7 inbound Pith citation observations for arXiv:2602.22809."}