{"as_of":"2026-08-09T11:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3fabf92e7c744e8f84661740a3cec0fe310afbbf0a3c4cf7c831080ca9d0eed","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:59:25.508500Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03385/citation-record","integrity":"/paper/2509.03385/integrity","json":"/paper/2509.03385/citation-record.json","paper":"/paper/2509.03385"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.658734Z","title":"HRS-Bench: Holistic, Reliable and Scalable Benchmark for Text-to-Image Models","venue":null,"work_id":"a3a45449-5e9e-4d94-81ef-da71f9592e73","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.187981Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:9c415aff325bc2256c83672843c758574cc0bfe204f86c7043a3ead9dcccc537","observation_id":"c599ab3c-c612-4883-8b18-501770399f70","resolution":{"observed_at":"2026-08-05T10:59:26.663617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.642858Z","title":"Videophy: Evaluating phys- ical commonsense for video generation","venue":null,"work_id":"6e6ee60e-3880-4d3c-b52c-daf087c78f32","year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.193027Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ba7be3992153aba8b955f9ff8fe7ae86e476222c2925c1cfc877bff2c6f9e0d8","observation_id":"fe314d61-6a32-40d5-b0c2-f66bac030e41","resolution":{"observed_at":"2026-08-05T10:59:26.647748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06800","last_updated":"2025-03-09T22:49:12Z","snapshot_observed_at":"2026-08-07T17:18:26.824890Z","submitted_at":"2025-03-09T22:49:12Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evaluation in Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06800","snapshot_observed_at":"2026-08-05T10:59:25.198610Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evalua- tion in Video Generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.198610Z"},"links":{"cited_paper":"/paper/2503.06800","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:d94f4d7cc20ceabdee6f3fd923fb52fb95aab2b720b027cbfee73d05f8097408","observation_id":"8814fc66-f840-41c2-83fd-f5297fd85d97","resolution":{"observed_at":"2026-08-05T10:59:25.198610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.627655Z","title":"Parkhi, and An- drew Zisserman","venue":null,"work_id":"5830f43a-f3b3-490b-8bdd-cf2e581c73b5","year":2018},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.203814Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:00f3e828949d71e584efda560d150c4580513e63e574def3da30f89ab81b8f6d","observation_id":"436c24cc-d651-43ff-bdc5-a4b83f42f5be","resolution":{"observed_at":"2026-08-05T10:59:26.633066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.611508Z","title":"Emerg- ing Properties in Self-Supervised Vision Transformers","venue":null,"work_id":"17313b88-1232-4ada-af90-5df2bcc83ad7","year":2021},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.209330Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:fb5ebc9cc13e40b676f0c60abc08f6cf6c306496ab06cfd8521c9bfe9ed995ad","observation_id":"bd40603b-14ea-4f75-9068-b28bf4deb1d9","resolution":{"observed_at":"2026-08-05T10:59:26.617217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.596128Z","title":"AnyDoor: Zero-shot Object-level Image Customization","venue":null,"work_id":"aed0405f-4c0f-41a8-950d-a12ac0cbd4d3","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.214269Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ae0feddd81e82ef6462815f56c52a363ef9884ca3e3339718b9f570cbe1b1cf6","observation_id":"f62c2a79-0b4e-4adf-9dcc-61ab2af8e0ec","resolution":{"observed_at":"2026-08-05T10:59:26.601577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.581164Z","title":"DALL-EV AL: Probing the Reasoning Skills and Social Biases of Text-to- Image Generation Models","venue":null,"work_id":"bd6e2508-75a3-4d5a-ae20-ae6084749956","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.219122Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:48e632ce7379401dd0a0d4a888a565e483412ab402bf1bf8f26c235e2637db93","observation_id":"54747dfa-2a88-4180-929e-69e065574e52","resolution":{"observed_at":"2026-08-05T10:59:26.585995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.565487Z","title":"ArcFace: Additive Angu- lar Margin Loss for Deep Face Recognition","venue":null,"work_id":"ac9a65a6-f0f3-4505-bb66-9c4bc6c8dd38","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.224574Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:7f220caf4899748437878bf028340f842c08cd0cc3c11a0824d87a945ac8300e","observation_id":"63f50de2-f1ed-42ae-ae7e-e849a234b566","resolution":{"observed_at":"2026-08-05T10:59:26.570583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10015","last_updated":"2023-10-27T17:24:04Z","snapshot_observed_at":"2026-07-06T14:32:48.360720Z","submitted_at":"2022-12-20T06:03:51Z","title":"Benchmarking Spatial Relationships in Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10015","snapshot_observed_at":"2026-08-05T10:59:25.229741Z","title":"Benchmarking spatial relationships in text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.229741Z"},"links":{"cited_paper":"/paper/2212.10015","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:9c3bce0e05223c9496c8d6c9306f7e3bfce49e3fc204f1c196b043876c98a53e","observation_id":"a5df3ae9-484b-47a3-9946-033742454da1","resolution":{"observed_at":"2026-08-05T10:59:25.229741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.550056Z","title":"GIQA: Generated Image Quality Assessment","venue":null,"work_id":"0c13852b-23fd-409c-8f0d-a04f6ee845cf","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.234736Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:7adbeed5300d8d4e94c8ebfdbff4218c085357042c46a63d7ef130d7823c406a","observation_id":"6ef0bf28-e169-43e9-a899-5f92a5de5cc9","resolution":{"observed_at":"2026-08-05T10:59:26.554873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.534528Z","title":"Mix-of-show: decentralized low-rank adaptation for multi-concept customization of diffusion models","venue":null,"work_id":"8e194108-55e9-4eed-b81f-9c2ccd47e116","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.239886Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:6422047a3fe4e99de14bb707bae22900317b6c3598e2ec92c11f2e4578ece86d","observation_id":"0933f34a-9495-479c-8e7e-db86aa8b683d","resolution":{"observed_at":"2026-08-05T10:59:26.539635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05939","last_updated":"2024-09-06T14:44:12Z","snapshot_observed_at":"2026-07-06T18:59:29.568123Z","submitted_at":"2024-08-12T06:27:29Z","title":"UniPortrait: A Unified Framework for Identity-Preserving Single- and Multi-Human Image Personalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05939","snapshot_observed_at":"2026-08-05T10:59:25.244664Z","title":"UniPor- trait: A Unified Framework for Identity-Preserving Single- and Multi-Human Image Personalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.244664Z"},"links":{"cited_paper":"/paper/2408.05939","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:41d81715411310dc54eec47d08681dac6d09bfd86e03cf20cef62cdf4cddb85b","observation_id":"b7fa93cb-8760-4faf-967d-0a014dc220f7","resolution":{"observed_at":"2026-08-05T10:59:25.244664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.517647Z","title":"VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feed- back for Video Generation","venue":null,"work_id":"d66c0eac-3e4f-40ed-98b9-b5beaacd7f5e","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.249939Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:eb1322324d509e6e0541d37f3ca835bcff7216d8cb3fca969b68ef88761c04d1","observation_id":"cdabd181-aaa1-456d-8f61-a0f31768d0ef","resolution":{"observed_at":"2026-08-05T10:59:26.523520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.501931Z","title":"Seman- tic Object Accuracy for Generative Text-to-Image Synthesis","venue":null,"work_id":"40818d67-737c-4468-b933-4b61ff7d6159","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.255013Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:19f9b4ffe25e6f56a38799a4382e1ee3e6beba91bd2d48f9949bc7c80a9cd255","observation_id":"c400a9e7-e3dc-4964-80ee-7610cd6cbc51","resolution":{"observed_at":"2026-08-05T10:59:26.507211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.485231Z","title":"Denoising Dif- fusion Probabilistic Models","venue":null,"work_id":"bb97620d-c8d6-4792-b3ad-8c866eb9a94b","year":2020},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.259730Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:08d7c25e2a218f011a018be53c7f9a7482835107efdedf35f4765ae03a31bd26","observation_id":"0d19bca6-a49e-4ea0-9d22-c04eb1d84e7e","resolution":{"observed_at":"2026-08-05T10:59:26.491431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.470371Z","title":null,"venue":null,"work_id":"21246392-0c1c-4cf8-9d90-3157046a6a71","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.264935Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ef82590cab66e15694013cba48db32de7a651a7101a3fbb68948bdcbf3cf9065","observation_id":"e5c2a792-cb9b-42c2-a13a-5192bc06fe8a","resolution":{"observed_at":"2026-08-05T10:59:26.474939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.455381Z","title":"A Style- Based Generator Architecture for Generative Adversarial Networks","venue":null,"work_id":"74850c9e-be3d-4e85-b004-1d149303652f","year":2019},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.269577Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:fd8bab5dd62f80851f008db2de2b92f63ef3ad481b4cde91970a1e655e68c8dc","observation_id":"0fd10c35-bcc7-4428-b92d-5bc9dd89c0d9","resolution":{"observed_at":"2026-08-05T10:59:26.460578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.440180Z","title":"Berg, Wan-Yen Lo, Piotr Dollar, and Ross Girshick","venue":null,"work_id":"c4550e4d-0770-4932-901d-6177fda6bde2","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.274027Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:b48fc0e3c7afe57a42c526b72a14e0475264ed16a804d4f8eeb4d61a9cf92919","observation_id":"cfa95bba-5eac-4dd7-8e7e-99e2c24d4ce2","resolution":{"observed_at":"2026-08-05T10:59:26.444801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.424868Z","title":"OMG: Occlusion-Friendly Personalized Multi-concept Generation in Diffusion Models","venue":null,"work_id":"df28dfd3-8013-4a6d-ad35-2f2f3dc2d5b3","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.278802Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:792d967b6e6c59d363a16c0627ee856dac60726a88f50e12f771fab6cf126a35","observation_id":"3a77c6a7-ad7d-47e8-8b65-d66da8fabaa5","resolution":{"observed_at":"2026-08-05T10:59:26.430358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.409440Z","title":"VIEScore: Towards explainable metrics for condi- tional image synthesis evaluation","venue":null,"work_id":"c43ae175-a23c-47f5-9fe7-4255ea97905f","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.283680Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:79c96f63cd18bc3a2d208558ed2835089cd438ca6606830d71098cd128de45ba","observation_id":"7185352c-f22e-450c-9ef6-e7513fdf3668","resolution":{"observed_at":"2026-08-05T10:59:26.413974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.394279Z","title":"Imagenhub: Standardizing the evaluation of conditional image generation models","venue":null,"work_id":"8e09112a-71f9-4be6-a25a-82f679ce663c","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.288008Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:39f602f916bcde215359998ba9b8ac63e7bf12eb42c1cd15f4ca2540968171ac","observation_id":"4ef2092d-9a26-4022-bf8e-cdd5f2d043f5","resolution":{"observed_at":"2026-08-05T10:59:26.399008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.378834Z","title":"Multi-Concept Customization of Text-to-Image Diffusion","venue":null,"work_id":"e5212cff-4861-4067-bd9b-0fc1a2abc2a7","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.293088Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:bd5b765d5c7476250d0888f8fccd6d03585a0147cd467de507edd439fa109965","observation_id":"0c69c52d-21df-4845-9d2d-9e7c35e6f23f","resolution":{"observed_at":"2026-08-05T10:59:26.383673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.363616Z","title":null,"venue":null,"work_id":"b7ffd89c-d607-46d5-a8fb-365dc654779e","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.297638Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:dbb3c99f3a9c6f506a80375726c3a1344324b79e39e1df1bb4df64d6b179fb3e","observation_id":"4254ded7-fb9f-46a6-b9b8-59ce91340016","resolution":{"observed_at":"2026-08-05T10:59:26.368536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.349136Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","venue":null,"work_id":"93d783cf-94a5-415f-8212-e4fd5bb0008a","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.302212Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:4e4c88fcfb884db0cddc97f04e1b3dc26684a861786febed14fea5e6b3d11611","observation_id":"1c7f0bec-e10a-49f6-b1af-d216dc26a2af","resolution":{"observed_at":"2026-08-05T10:59:26.353779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.333738Z","title":"Image Synthesis From Layout With Locality- Aware Mask Adaption","venue":null,"work_id":"2ba13f7b-b6f2-43bc-a10a-4e13448db468","year":2021},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.306995Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:8a878ceefc915bde732be80ae6b415a0850f5e658ad0971e3fa164cb409af70f","observation_id":"f97036b4-8a8a-4d9f-8cd7-a96db6eb84c6","resolution":{"observed_at":"2026-08-05T10:59:26.338693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.318897Z","title":"Lawrence Zitnick","venue":null,"work_id":"8488055c-af6f-484f-b37b-933d29e7f97c","year":2014},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.312019Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:0a84f8f5cf444d4e58c81e531aab65130702457f62dca4de265f220adbeaeb7c","observation_id":"0c7e291c-f3cc-4441-a1ff-ab1d7d8c8332","resolution":{"observed_at":"2026-08-05T10:59:26.323590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.303642Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":"f0d892c4-b65a-451e-9550-65eb09051fb1","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.316997Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:8fc63c1ee8e1dbd795520e9d5e4d6842b374cd7c6cfea04be63b98c9a1a5bdd5","observation_id":"f1fdb08f-4581-40d2-9558-0a8d039a4d33","resolution":{"observed_at":"2026-08-05T10:59:26.308597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.286480Z","title":null,"venue":null,"work_id":"65001262-4cc2-4b35-b049-6c26d8755157","year":2020},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.321649Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:560ba5266861293e4258779fb2309da4f1ebbe7122e52d915c8d0ddb877c4bdb","observation_id":"65365a27-bc55-4c44-a451-893ecef85dcb","resolution":{"observed_at":"2026-08-05T10:59:26.291931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.270871Z","title":"Grounding dino: Marry- ing dino with grounded pre-training for open-set object de- tection","venue":null,"work_id":"1dbd46b2-b1b0-45d3-8b02-8841305434f2","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.326325Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:b3781802d96748a8a58bdeea5662d160a8e4d968ec1e3b532959c6085e8029e7","observation_id":"435c8c57-80e3-4ac0-bcdf-f3ef62fde7e8","resolution":{"observed_at":"2026-08-05T10:59:26.275665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.256094Z","title":"Cones 2: customizable image synthesis with multiple subjects","venue":null,"work_id":"c1c5c8b9-c0b5-4950-bb3d-8b0849ee794e","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.331202Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:403a0a29f25893ad51cb3ff4edd5138a2af0a92c55591de2afa0be20cd428013","observation_id":"55597837-c55b-4635-9058-cb6cfa2b3f21","resolution":{"observed_at":"2026-08-05T10:59:26.260864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.240680Z","title":"Subject- Diffusion: Open Domain Personalized Text-to-Image Gener- ation without Test-time Fine-tuning","venue":null,"work_id":"2ba2f963-c961-44f4-b914-13b4b8635742","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.335795Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:2ce6a71e202bc35a0814846fc1ed3f26dac6cfa382a2a9c7dad23209f72d16fd","observation_id":"2c36f1ff-1a21-4d45-92b6-f84185677af2","resolution":{"observed_at":"2026-08-05T10:59:26.246063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.225172Z","title":"Towards a Bet- ter Metric for Evaluating Question Generation Systems","venue":null,"work_id":"914e28a9-c6d4-4363-a49f-fd3023535fb5","year":2018},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.340987Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:6f10e5018e4d9249d801251c94936a0c83652644532c433fb0b36a3c3d472743","observation_id":"99ba8989-f8a4-4360-8e94-f691aeca2990","resolution":{"observed_at":"2026-08-05T10:59:26.230109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.345690Z","title":"Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.345690Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:55cd6c5a8779cefc68cc83a496b3300d6a76456e3a908ebe4179546bfb5c9687","observation_id":"f3729ba3-2a8f-42ff-9c0a-1f27c838bfb2","resolution":{"observed_at":"2026-08-05T10:59:25.345690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T10:59:25.350517Z","title":"GPT-4 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.350517Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:c60702902302f9f25f2d3785e240306f45df611370dc1526aab9d7a71e3865c9","observation_id":"0021bc9e-f327-4c84-b363-dfadf2486494","resolution":{"observed_at":"2026-08-05T10:59:25.350517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.209293Z","title":"Dreambench++: A human-aligned bench- mark for personalized image generation","venue":null,"work_id":"8f66a3b4-19f9-4977-ae76-995687bfe6f2","year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.355680Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:d3e8a058b18a9edc76bb91ac8ed7527acac58aa846e622e331107a4a5e0a9c59","observation_id":"f61ba8c5-6e60-44e5-9244-488b322575fa","resolution":{"observed_at":"2026-08-05T10:59:26.214960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.194325Z","title":"Grounded Text-to-Image Synthesis with Attention Refocusing","venue":null,"work_id":"6abf28c5-8039-48b1-97e0-4cfd1c1d44fb","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.360671Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ce81c9087c067a19198c5ba1897e05094032fe9ac089aa34cd6e57b7988c66df","observation_id":"a15a48e3-7f38-4583-a64c-babd0c1768e0","resolution":{"observed_at":"2026-08-05T10:59:26.198993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.179110Z","title":"Plummer, Liwei Wang, Chris M","venue":null,"work_id":"e676d729-623b-451f-af10-dd6104312739","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.365139Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:7f6e0d69ba200d2a9df5791419b4bff67f2db6b8a6c9b46bac4a0cbe12d2a85f","observation_id":"0399363f-4586-4a42-9ab3-7afffbf0b934","resolution":{"observed_at":"2026-08-05T10:59:26.184213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-05T10:59:25.370039Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.370039Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:76912f41393d0c899ef7a375717e812328535af42bba72cd4107d2a7bb94f63c","observation_id":"0868e31e-b2fe-4ff4-83f1-1417e4a43085","resolution":{"observed_at":"2026-08-05T10:59:25.370039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.163845Z","title":"Learning Transferable Visual Models From Natural Language Supervision","venue":null,"work_id":"0b7edda4-32ae-41b8-84a3-613c71d2b1ba","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.375259Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:17e0108c5fe0d2f5c2c426b92f3967765eebf19fb0a27ea5c84041bab236a49d","observation_id":"c8adedfb-a5c9-4a29-886a-feb4fca7d415","resolution":{"observed_at":"2026-08-05T10:59:26.169106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.147652Z","title":"High-Resolution Image Synthesis With Latent Diffusion Models","venue":null,"work_id":"6c1d771f-7714-4b69-920a-b899d87c9d1f","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.380273Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:3fea7c300a88ad8f02cd63bf167ecc3b9e65373707146969aba62216547cce43","observation_id":"dbfb5981-7c40-40e7-a3fe-9ff608c2c226","resolution":{"observed_at":"2026-08-05T10:59:26.152731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.129159Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"56da0817-8e49-4115-b42e-e0c2319c61cf","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.385752Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:28dab1800a22ba82f334c0ac862ece6c203fad6c5b2e7ab7edbbf9c5af10ced3","observation_id":"ce38188d-23e6-4b2e-a94c-f23b62719e35","resolution":{"observed_at":"2026-08-05T10:59:26.134183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.113566Z","title":"Sara Mahdavi, Raphael Gontijo-Lopes, Tim Salimans, Jonathan Ho, David J Fleet, and Mohammad Norouzi","venue":null,"work_id":"69190162-51a5-4c55-90c6-33b66370cc2d","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.390333Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:cc4c0c66523acb91558556c4089ed1980ae36566147582c488c2e3aa340cee23","observation_id":"2935ac23-a612-4ea3-8cbe-23ad47fd9f3e","resolution":{"observed_at":"2026-08-05T10:59:26.118688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-05T10:59:25.396135Z","title":"LAION- 400M: Open Dataset of CLIP-Filtered 400 Million Image- Text Pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.396135Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:c0a6a91e10083c671e91bfd36ef3fd879b868d2c7a9d3493363813d50bd3e126","observation_id":"b0006f67-5ed1-4863-858d-c4dfa3b7dfd2","resolution":{"observed_at":"2026-08-05T10:59:25.396135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.08402","last_updated":"2022-10-16T00:08:18Z","snapshot_observed_at":"2026-07-29T21:51:47.064287Z","submitted_at":"2022-10-16T00:08:18Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.08402","snapshot_observed_at":"2026-08-05T10:59:25.401255Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.401255Z"},"links":{"cited_paper":"/paper/2210.08402","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:b5d1b1f3f690482e0259e1b5127647e08f49538548d15536d81134c19bb927fa","observation_id":"298eef0a-a9b1-4daa-aeac-a70f9402e00c","resolution":{"observed_at":"2026-08-05T10:59:25.401255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.096012Z","title":"NTU RGB+D: A Large Scale Dataset for 3D Human Activ- ity Analysis","venue":null,"work_id":"013e663c-ae7a-4b84-8832-3d5c3624b047","year":2016},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.406793Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:2c1496eff330569058a8996031eef81631e3bde34ddd0ad1b8ca8b0a0922def0","observation_id":"8cb8850a-fa4b-4324-adff-8488e2b1de30","resolution":{"observed_at":"2026-08-05T10:59:26.101967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.080662Z","title":"Weiss, Niru Mah- eswaranathan, and Surya Ganguli","venue":null,"work_id":"e84c2d3f-42c1-4645-9c1c-eebcced8e4ca","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.411402Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:a47192a0f49f7f6d7296a280772e5a9c0c9b749406e6e9204ddad0e2882e6f9c","observation_id":"316cc1f5-4345-4df9-9c41-80115dbd09fa","resolution":{"observed_at":"2026-08-05T10:59:26.085634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.4842","last_updated":"2014-09-17T01:03:11Z","snapshot_observed_at":"2026-07-06T03:54:42.722883Z","submitted_at":"2014-09-17T01:03:11Z","title":"Going Deeper with Convolutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.4842","snapshot_observed_at":"2026-08-05T10:59:25.416483Z","title":"Going Deeper with Convolutions","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.416483Z"},"links":{"cited_paper":"/paper/1409.4842","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:0f256934e61c63f229e0dea05ac627c37d68408e82973c6759811ea05aee4303","observation_id":"429402f3-bc08-4b5d-aec4-aaeffbd7ca3b","resolution":{"observed_at":"2026-08-05T10:59:25.416483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T10:59:25.421373Z","title":"Dai, Anja Hauth, Katie Millican, and David Sil- ver et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.421373Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:08f84f538261ed9ace4a77fc1e34b3e13285501c90c35f08d1a6ea8b6ff1ad41","observation_id":"ebe11196-7118-4759-89a1-0f032d7d2bfa","resolution":{"observed_at":"2026-08-05T10:59:25.421373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.064954Z","title":"Diffusers: State-of-the-art diffusion models","venue":null,"work_id":"c31fee18-8214-46aa-ac97-9821ec62f192","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.427277Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:b31de31ae8ef973a01810d505ee2cac28a1b7a15572956c9613f49a2cc3ecd16","observation_id":"d23d6a0f-4a28-46b2-afd7-f564ee6eafa7","resolution":{"observed_at":"2026-08-05T10:59:26.070226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09522","last_updated":"2023-07-15T15:48:48Z","snapshot_observed_at":"2026-08-06T13:58:29.349698Z","submitted_at":"2023-03-16T17:38:15Z","title":"P+: Extended Textual Conditioning in Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09522","snapshot_observed_at":"2026-08-05T10:59:25.431963Z","title":"P+: Extended Textual Conditioning in Text-to- Image Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.431963Z"},"links":{"cited_paper":"/paper/2303.09522","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:49225364fb330582421931da42168961ff222e406c3e998ff9077283266bd63d","observation_id":"07aec872-ed83-48f3-9d7c-e1616c3be7f7","resolution":{"observed_at":"2026-08-05T10:59:25.431963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17221","last_updated":"2024-11-26T08:43:15Z","snapshot_observed_at":"2026-07-06T19:57:10.411888Z","submitted_at":"2024-11-26T08:43:15Z","title":"AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM","version":1},"cited_work":{"arxiv_id":"2411.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17221","snapshot_observed_at":"2026-08-05T10:59:25.625707Z","title":"AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM","venue":"cs.CV","work_id":"3b524383-ac7b-4934-9807-b89a7977c58b","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.437314Z"},"links":{"cited_paper":"/paper/2411.17221","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:1589f7769ad57a00fb5155bb8b127b5b93c1c321cfbc9e021fe9c93aae7932f9","observation_id":"38528513-0f4a-490c-a1e8-48f336dae96c","resolution":{"observed_at":"2026-08-05T10:59:25.630556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07046","last_updated":"2025-04-09T17:04:14Z","snapshot_observed_at":"2026-08-07T16:07:07.841461Z","submitted_at":"2025-04-09T17:04:14Z","title":"A Unified Agentic Framework for Evaluating Conditional Image Generation","version":1},"cited_work":{"arxiv_id":"2504.07046","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07046","snapshot_observed_at":"2026-08-05T10:59:25.603536Z","title":"A Unified Agentic Framework for Evaluating Conditional Image Generation","venue":"cs.CV","work_id":"85d289d1-967e-4c3e-9ac1-dc9dd32233af","year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.442343Z"},"links":{"cited_paper":"/paper/2504.07046","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:15bc5738f17e404e763766f9fc6e9d57a2634aa4c5a7abf00e72f7dd1b9257e9","observation_id":"c5b1c0be-11ca-4d73-8f20-768a3ad58ce0","resolution":{"observed_at":"2026-08-05T10:59:25.608823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02381","last_updated":"2025-02-28T23:33:22Z","snapshot_observed_at":"2026-08-04T16:58:26.946941Z","submitted_at":"2024-10-03T11:01:25Z","title":"MetaMetrics: Calibrating Metrics For Generation Tasks Using Human Preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02381","snapshot_observed_at":"2026-08-05T10:59:25.447712Z","title":"MetaMetrics: Calibrat- ing Metrics For Generation Tasks Using Human Preferences","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.447712Z"},"links":{"cited_paper":"/paper/2410.02381","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:eaef2981c1db0497e1c5a28b09694572f8d2845fddd9d3ba1788da2c38ef54a8","observation_id":"1222bc61-b6f9-43d4-8f9e-6dd8c40ffbe7","resolution":{"observed_at":"2026-08-05T10:59:25.447712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.048917Z","title":"Q-Align: Teaching LMMs for Vi- sual Scoring via Discrete Text-Defined Levels","venue":null,"work_id":"9f38885f-a3b1-4f17-ac46-5bc9b340163c","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.452535Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:a51a057b412fb562b99ae268e7bcb30c3fc67bd0e6d578d49916132f7aa8559e","observation_id":"c18b939d-e1e9-466f-9d84-46bb873e2f98","resolution":{"observed_at":"2026-08-05T10:59:26.054235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.033149Z","title":"Freeman, Fr ´edo Durand, and Song Han","venue":null,"work_id":"6dd462d8-1e91-46b8-8882-7a34eec8da5b","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.457998Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:c3394f1875d4107d9909864ad587306c029e7de35ca07b0227a2f2d300289546","observation_id":"32f27f7a-ff86-4000-9462-b39e2de7764c","resolution":{"observed_at":"2026-08-05T10:59:26.038385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.016172Z","title":"Imagereward: learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"3eca138a-79d8-4746-aea3-5f36abcbdea4","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.462627Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ed1fe0dd10aa74898ffefb78a687af2657c33c3451f82908d897032b960b1e0c","observation_id":"68ba6e7e-0c1f-4ae1-b375-e9f30eeea7c7","resolution":{"observed_at":"2026-08-05T10:59:26.021759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.000012Z","title":"From image descriptions to visual denotations: New similarity metrics for semantic inference over event descrip- tions","venue":null,"work_id":"a6954fe6-1615-4f35-9b19-46d98afbc00e","year":2014},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.467230Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:c5477aa111b464b072dbc3da08ee945b066972b90b6b0916cb1839743b2f36ac","observation_id":"ca2cf8e9-42a1-4087-bce4-6565c8c23a1b","resolution":{"observed_at":"2026-08-05T10:59:26.004937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15862","last_updated":"2025-01-16T06:07:12Z","snapshot_observed_at":"2026-07-06T19:56:08.504922Z","submitted_at":"2024-11-24T14:38:59Z","title":"Do LLMs Really Think Step-by-step In Implicit Reasoning?","version":4},"cited_work":{"arxiv_id":"2411.15862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15862","snapshot_observed_at":"2026-08-05T10:59:25.563147Z","title":"Do LLMs Really Think Step-by-step In Implicit Reasoning?","venue":"cs.CL","work_id":"e78861dd-e1b4-45eb-a594-0e2e4f5bbb10","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.472816Z"},"links":{"cited_paper":"/paper/2411.15862","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:70c78181f91d0bfb08bbaf2a00254ff787be165a35dd413cd0e3e4a6277fba14","observation_id":"17d3516d-a812-4564-bd2d-f200f0df8ee5","resolution":{"observed_at":"2026-08-05T10:59:25.569931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.982240Z","title":"Joint face detection and alignment using multitask cascaded convolutional networks","venue":null,"work_id":"027f3898-10e1-4064-9243-e0e7b1e0f88e","year":2016},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.477888Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:6781cf6849578a53ce747028e9411d54d1a30427d3563886a02b904b1cadfaae","observation_id":"0d823e10-f84d-48a0-8299-26cdc2588532","resolution":{"observed_at":"2026-08-05T10:59:25.988120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.964628Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","venue":null,"work_id":"fd41b594-6fbd-4c96-8bc8-98dff9806995","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.483107Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:67c6afca79a306b4856413f643ef59fb36310ec83c238a272431fabe152d2563","observation_id":"d90bafaf-62e0-4b2f-9285-c79cece63472","resolution":{"observed_at":"2026-08-05T10:59:25.969848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.947528Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":null,"work_id":"af10b73b-8812-436e-972a-d5ca4cb79219","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.487821Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:78778388f81437d6c49ee22f4222251ed49e76ed602dee3b9ce124b61761cd65","observation_id":"0f7c9d09-bebb-4079-a423-a0da2835699a","resolution":{"observed_at":"2026-08-05T10:59:25.953113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16843","last_updated":"2024-11-19T02:52:45Z","snapshot_observed_at":"2026-08-06T19:03:44.030685Z","submitted_at":"2024-02-26T18:59:18Z","title":"Multi-LoRA Composition for Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16843","snapshot_observed_at":"2026-08-05T10:59:25.492941Z","title":"Multi-LoRA Composition for Image Genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.492941Z"},"links":{"cited_paper":"/paper/2402.16843","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:b1b5ca62ae4b8cb92f7b6ec3cd2cf06348eb16833a6d8edf400b60f8f411d712","observation_id":"532727e3-fc14-42dd-b45b-baee8ae1076b","resolution":{"observed_at":"2026-08-05T10:59:25.492941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.930490Z","title":"Sim- ple multi-dataset detection","venue":null,"work_id":"7b5665e1-56a0-4747-9c3c-00810ed21b74","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.497812Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:3486ca30b157d887f9292cc623d9b64153dd6daaae99fda2cabd8c78b582554d","observation_id":"d7eece6c-bcff-4f61-b8b4-1e2d2d221c3e","resolution":{"observed_at":"2026-08-05T10:59:25.935618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.911871Z","title":"noisy, blurry, soft, deformed, ugly","venue":null,"work_id":"b92c8be7-78aa-451a-89c5-1da59bde35b6","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.503244Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:718fce89768389c6d6cfddd985070c929c14b92bde9a67602d36d3023962ca15","observation_id":"d9f0ae3c-0f54-4adc-94ef-6deca4d71f5f","resolution":{"observed_at":"2026-08-05T10:59:25.918317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.895580Z","title":"<Text prompt>","venue":null,"work_id":"41456882-62f0-47b2-8227-4fc6a2e9e1fd","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.508500Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:e28f30f4c93295e20deb800df3114c7b6a7f0abc0b1a4e979d9ca7ca4f2fbb97","observation_id":"587e5dd6-79c2-44cb-8b2e-630b231e6ad6","resolution":{"observed_at":"2026-08-05T10:59:25.901110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T21:04:36.444975Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":3,"verified_fuzzy":46},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2509.03385."}