{"as_of":"2026-08-11T08:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5174007a1ba757cd8c2444b728c996f7fbcabe2445e0fd7e1f62dfc9c60e4c11","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T22:52:41.592714Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:42:54.057921Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.10955","snapshot_observed_at":"2026-08-01T15:42:54.057921Z","title":"Omni-attribute: Open-vocabulary attribute encoder for visual concept personalization.arXiv preprint arXiv:2512.10955, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18237","last_updated":"2026-07-20T17:59:51Z","snapshot_observed_at":"2026-08-07T21:57:23.683434Z","submitted_at":"2026-07-20T17:59:51Z","title":"The Many Senses of Visual Similarity: A Text-Prompted Image Perceptual Metric","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T15:42:54.057921Z"},"links":{"cited_paper":"/paper/2512.10955","citing_paper":"/paper/2607.18237"},"observation_digest":"sha256:ca700e472a2835d8b55129bb882bcd03fc7df8d67809a64298de1a94c5dbb1cc","observation_id":"084f9d75-3c5e-4095-bc25-415c17a4a686","resolution":{"observed_at":"2026-08-01T15:42:54.057921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.10955/citation-record","integrity":"/paper/2512.10955/integrity","json":"/paper/2512.10955/citation-record.json","paper":"/paper/2512.10955"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Break-a-scene: Extracting multiple concepts from a single image","venue":null,"work_id":"43c12c58-9ca8-4e28-a9bc-e7b65d7c47f6","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:bdcfdf876ef8fbcf2c5a05715daf0b530f1b3bdb53db40c7a58337c23ffc1fa1","observation_id":"a135afec-0fd4-45ef-bc05-9bf6e3c8f215","resolution":{"observed_at":"2026-05-16T22:53:38.485849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Animal image dataset.https://www","venue":null,"work_id":"ad5190ea-e224-4903-91ce-11f2da8142c1","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:64d5689f27d8f8d20aa79a2bd919a2511b319c0540a4cc648ab899896e20afaa","observation_id":"54adecc3-18a4-4205-b653-7572216e7008","resolution":{"observed_at":"2026-05-16T22:53:38.572425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Precisecam: Precise camera control for text-to- image generation","venue":null,"work_id":"a6d3fad1-c699-4003-b48d-007f4b539b7e","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:fc1f43a9b86d6666a45fdef9accbdb80eb8713a651b53d760bed1c406cf1a2e6","observation_id":"cf0cb2bf-b820-4df3-9514-4ab1588e119d","resolution":{"observed_at":"2026-05-16T22:53:38.521875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"5ac1a2fb-b289-4ef3-a8c7-20fd1e60f483","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:9b33813f4d1299a7c99146d25c6f821afb1e43652de5e92be757ad77114adee6","observation_id":"bbaaf0ba-458a-4bef-9581-83cafe6b974d","resolution":{"observed_at":"2026-05-16T22:53:38.617940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsupervised learn- ing of visual features by contrasting cluster assignments","venue":null,"work_id":"7232d071-a904-4398-b7d9-f5824dbbcc7a","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:44e3da11608256f5ae996d27a3d934577e46e2707767415361486bf9887b03e2","observation_id":"d4d070ba-df19-4d52-8414-21f4484d58d1","resolution":{"observed_at":"2026-05-16T22:53:38.509359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":"d08691b7-2390-472c-ac36-389c2cd266c8","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:5e3eaab0715432df1d5ebdca2baf17d65e7db91f2767bdebee514b813bff79e4","observation_id":"90d269b4-8426-4451-845d-3095fcd3b52a","resolution":{"observed_at":"2026-05-16T22:53:38.512705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"d093b5b2-ed43-495a-87e3-7bf0fa84a8e3","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:21ccdde1a15e5aba5c2cabf4e0608cad38498284c7f54b8b52e71f4eb9228415","observation_id":"937234cc-6818-4654-aeff-3744c6afdb2e","resolution":{"observed_at":"2026-05-16T22:53:38.630545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Incremental false negative detection for contrastive learning","venue":null,"work_id":"be9608ba-5621-4567-8950-632a78ab5155","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:c3b10a739f6ab15ef9d1e3f40bb01ddb7447085a6793f4ddd6190c1da7757664","observation_id":"dcdb0c6e-50c1-41d8-b101-d7c9dc54a0d8","resolution":{"observed_at":"2026-05-16T22:53:38.582713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14404","last_updated":"2023-04-27T17:59:32Z","snapshot_observed_at":"2026-08-07T22:08:50.194742Z","submitted_at":"2023-04-27T17:59:32Z","title":"Motion-Conditioned Diffusion Model for Controllable Video Synthesis","version":1},"cited_work":{"arxiv_id":"2304.14404","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.14404","snapshot_observed_at":"2026-07-03T22:49:00.819668Z","title":"Motion- Conditioned Diffusion Model for Controllable Video Synthesis","venue":null,"work_id":"4f9964d7-7be1-4a28-a838-32c54a1da3e5","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2304.14404","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b10085196544e4f81c444d1eb4b95ef821e0d50591eb95585322ca4bcfba7523","observation_id":"feceba76-bc59-4378-b363-919cf6c626cd","resolution":{"observed_at":"2026-05-16T22:53:38.272429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers","venue":null,"work_id":"7c0a9e50-7050-467b-bf4f-349d6759f45d","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:70244b031ae879bd5a7c99376a062ba7d07c0129b614aa69d60f62dca3bece83","observation_id":"bb4ca136-5e46-4ed5-a2ea-23f7d15b347c","resolution":{"observed_at":"2026-05-16T22:53:38.527721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-subject open-set personalization in video generation","venue":null,"work_id":"5b6e8462-0eff-4627-9c67-563b7933bf41","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:476dbc6674b101b106c8f3e35e0dcc57d0a13152fb6cccc0f7430cdbe63c1782","observation_id":"c3dcf6d3-ef52-4cdd-a394-70cfdcfbd8cf","resolution":{"observed_at":"2026-05-16T22:53:38.524800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual categorization with bags of keypoints","venue":null,"work_id":"2090fa98-f0b3-4318-b33d-315f767d3a5c","year":2004},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:8ec5c38a3cfad2587a19b2682a01b229d6bf1b3e1415edde8e2d7ae543a26182","observation_id":"87595701-2c10-4da9-ac9c-acc1b40edef9","resolution":{"observed_at":"2026-05-16T22:53:38.580095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"e3203473-3407-40e6-99c2-a72c9d7d3dad","year":2009},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:84563b1b9d4992ef0ec9b9b753a2b0ce2e70b14e165d65cd1466960e6a21e18d","observation_id":"6c79b5a1-dfd3-4ad1-b9c1-59bf28e47957","resolution":{"observed_at":"2026-05-16T22:53:38.553420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"3e1c179a-7703-4b49-a701-67ecb10f5905","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:1494e0ccdfa777a537aa05ba35dc7e3231a86ae0ebf4b4d7d0ebf07e65e9ed36","observation_id":"dded502d-6187-4f71-a0e7-5c75d4709148","resolution":{"observed_at":"2026-05-16T22:53:38.548167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VIMI: Grounding video gen- eration through multi-modal instruction","venue":null,"work_id":"bd2e3425-082b-44fc-a5bb-dc3bc3479ef1","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:e8ba5ada44cfc68e897c751253432386fdd06ec529eba447c5abcc322f8d47b6","observation_id":"f552ea87-10fc-4051-a26a-0961696a808f","resolution":{"observed_at":"2026-05-16T22:53:38.566772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":"5ce014bc-8d11-40a5-9c8d-896741128ba2","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:71180dacdb042668583e9820be2ae1d9d0dcb362621f370f62ecaf2284aca412","observation_id":"40e3e553-fd8d-44aa-9caf-591c1b06ee37","resolution":{"observed_at":"2026-05-16T22:53:38.550922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tokenverse: Versatile multi-concept personalization in token modulation space.SIGGRAPH","venue":null,"work_id":"a04c0814-8251-4920-b8d0-0c7e5c7e2550","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:8bd7cf46b623439f5656dbafd9a44983f8df97fffeb9350442f3a2bf8151258c","observation_id":"d3a325dd-bb80-4322-b9a5-27c31f328180","resolution":{"observed_at":"2026-05-16T22:53:38.569555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nano banana.https://aistudio.google","venue":null,"work_id":"589f460c-7409-4105-8c81-6fb0575866af","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:810508078ec10cba0f6c52fc9318025f96f936d0fc748b1704d3aeac428e64d2","observation_id":"6f0e21ae-1561-42cd-8b1c-17f0d2c088e2","resolution":{"observed_at":"2026-05-16T22:53:38.590793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preventing shortcuts in adapter training via providing the shortcuts","venue":null,"work_id":"e2ae1c41-2260-4ada-9583-1cf2ddef0179","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:e2904e4fee426e6c42a9f924452923eaa49b450bbbab1317837bd8465514f55b","observation_id":"9f4a8243-b34e-491b-a937-b661e44e2653","resolution":{"observed_at":"2026-05-16T22:53:38.575134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bootstrap your own latent-a new approach to self-supervised learning.NeurIPS","venue":null,"work_id":"e9a9c82a-060a-49ba-8ae3-a0cb20fe7bb0","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6f19821c84c99681c057f5560b040da360878e51fc6ed7c6dc99cd4c98d4149f","observation_id":"2a0263df-9435-46ae-91cc-82c3727db99f","resolution":{"observed_at":"2026-05-16T22:53:38.545110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-08-08T10:55:01.205999Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":"2407.03168","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-07-04T06:19:38.680614Z","title":"Liveportrait: Efficient portrait animation with stitching and retargeting control","venue":null,"work_id":"a6d04417-1655-4dfd-91f6-8ac466a59dab","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6326ce094eee0bf6567db631a20a13c7017689cd966621e4849402a2fcc3bb22","observation_id":"fe463ee4-32d2-4954-a820-83078ba7c67e","resolution":{"observed_at":"2026-05-16T22:53:38.289613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conceptexpress: Harnessing diffusion models for single-image unsupervised concept extraction","venue":null,"work_id":"0ccfe849-5fb4-45ce-80b3-aa3c7e5e63e9","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:512854573d07b4b18527388ed63d887b6f3f4266ac1dbffba8a76a0fc91ccb5f","observation_id":"4d399520-422d-41ec-883c-30ee4e787c17","resolution":{"observed_at":"2026-05-16T22:53:38.558370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:32:22.378602Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"489ff65e-fbed-4844-b013-17245f02b106","year":null},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:e811db8ab96c91087b3f75997ae657e980316894f96d51837fc65e9d27c97c55","observation_id":"906b4555-49b0-4cd8-a437-b57cd4a188ef","resolution":{"observed_at":"2026-05-16T22:53:38.539578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":"d4303681-e35f-40f2-a61b-33be7a5c5871","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b0d939f7c8b31f25fd48e1dda072e34a5b05504be90209f193c2f2d0be8a6cbe","observation_id":"3563c2fb-5c2e-434e-ad31-b0a8e4d0a150","resolution":{"observed_at":"2026-05-16T22:53:38.500399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"b08bdf77-e907-427e-bb08-77a486be1b54","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:9f0d32e4a8b7154d5320c011e7deb2273ea39691c05ed2988bffabb46798d412","observation_id":"7dffbf1d-4e0f-4915-9c08-d34a031164ac","resolution":{"observed_at":"2026-05-16T22:53:38.542362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":"2208.01626","doi":"10.48500/arxiv.2208.01626","metadata_source":"pith","pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","venue":"cs.CV","work_id":"196f7eef-d65a-47e4-b815-9a188f6aedcf","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:109a4134536c842285be963ea2b31c614ace2081c1b0f6f3e3762aa2e4b3be96","observation_id":"b18a65ea-0da1-4ab5-b52e-dd0f5f45fe27","resolution":{"observed_at":"2026-05-16T22:53:38.292773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":"a1e1c797-b29c-40f0-a5dd-fe49b89c1992","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:2d091731311849cc34834cb8143a79d7854b2ee2e5e6f606033d46f978832015","observation_id":"cf155831-b3d1-4ab8-af6a-4ef9786b22db","resolution":{"observed_at":"2026-05-16T22:53:38.536463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:51:39.654684Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"775d20cd-9115-46d8-9a4e-949d4c618b5c","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:5c7a1674c17fc0e7f65e3f7ca3610e8b2e8d5f853d0b1e01359c87a217732b6a","observation_id":"802da1e1-8b74-496d-9faa-f29e39a57cde","resolution":{"observed_at":"2026-05-16T22:53:38.585200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"4ebd6af6-23f8-409b-9e80-a03602f12ff2","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:d357c3c74bc177a4c70e2f7c8298b9d17479f0fefef2c3fd79e5d949da4956db","observation_id":"6d6dd839-fc04-47f5-9cc9-8dc082e8b329","resolution":{"observed_at":"2026-05-16T22:53:38.588177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instantx flux.1-dev ip-adapter page.https:// huggingface.co/InstantX/FLUX.1- dev- IP- Adapter","venue":null,"work_id":"0a00d9ae-1287-4c10-b29c-45d615225159","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:e4174eebf08642995b118121032b82d4a3ac951797c8a68a84a6e748e470e20f","observation_id":"6cb43bbf-2d3a-48c6-85cc-4e9ebefab888","resolution":{"observed_at":"2026-05-16T22:53:38.555645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:cc207c9182e44478981e8a8c2aefb953c344d14e46de552c179a4e84b87ee0a2","observation_id":"ecb04a37-444c-4db8-8ea4-e028414db28c","resolution":{"observed_at":"2026-05-16T22:53:38.275729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet classification with deep convolutional neural net- works.NeurIPS","venue":null,"work_id":"d295ef2c-1a14-4fa2-b20e-0a3d31626f39","year":2012},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:23591c857c8ec562517c52ebd23319ee18fb4af715aa1299b893a1efe131bbbf","observation_id":"c1ffa7af-f31d-48ce-ad01-5c5e1592aaeb","resolution":{"observed_at":"2026-05-16T22:53:38.564134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"3eda3c77-e76c-4450-8ee7-66251f0dd344","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:cc9b2e643db7578b23637de066aaf8522828d9aa95575180b2ca0a354b3af511","observation_id":"139a0520-ff74-4325-8277-6619c126c66c","resolution":{"observed_at":"2026-05-16T22:53:38.560686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux.1-dev.https : / / huggingface","venue":null,"work_id":"16379aa4-0ad5-49ae-8f48-fa7a9ae4efe7","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:afcf36f6e4c3a6e17b0d2e75469a8151cb7c751e93dc5ad5c976fa207c150ace","observation_id":"818d75ca-cf3d-4294-89eb-0464e28c28ca","resolution":{"observed_at":"2026-05-16T22:53:38.593538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-08-10T10:43:25.582099Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":"2506.15742","doi":"10.48550/arxiv.2506.15742","metadata_source":"pith","pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","venue":"cs.GR","work_id":"5dfe19d5-3541-4803-8fe9-3c8b9e29b281","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:676547edf79f59ce6b63f9fddd1a0bf12b997f2f3c1e9ebc527b90b439207181","observation_id":"b455a4fa-a58f-47e8-8ebc-d82d74b8534f","resolution":{"observed_at":"2026-05-16T22:53:38.278959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distortion-adaptive salient object detection in 360 omnidi- rectional images.IEEE Journal of Selected Topics in Signal Processing","venue":null,"work_id":"2863fe55-7f25-4582-b117-2f70b346e70b","year":2019},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:76f26a13043bb75ebd3ad894ec525df2318a60a083a7b55fc5bf243b9393c888","observation_id":"49c7002f-fa34-40f3-94f8-6cfba3063899","resolution":{"observed_at":"2026-05-16T22:53:38.530814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a3d4ad7d-6995-42f3-a651-7ee93e10bab2","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:ae38011658d08e4384c10965ea2670fa9bdfcad86341a2db033fc01f4108608e","observation_id":"f9b029dc-2fe0-48be-809f-df30aa894874","resolution":{"observed_at":"2026-05-16T22:53:38.614824Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional visual generation with composable diffusion models","venue":null,"work_id":"c4c0c1ea-1ecb-4feb-acfd-aa51633a94e5","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:af9d8678eb1ce756c8770bf47b5d563a76460d3930e2d73d45e730b639ba4b4c","observation_id":"7bd59cee-5107-4d86-b731-4b1a00fc9bfd","resolution":{"observed_at":"2026-05-16T22:53:38.604881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":"2504.17761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-10T01:46:41.223286Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","venue":"cs.CV","work_id":"3392f2c8-a1cb-4d6c-8c82-2cdccffa33f9","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:8561613c4197891b2254d9f5da5e3073b64a97c66040e916cbdebfec01acb00a","observation_id":"c07f82d2-fc5f-4fcc-84a2-82454c1b86c6","resolution":{"observed_at":"2026-05-16T22:53:38.268979Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep learning face attributes in the wild","venue":null,"work_id":"5e622d0b-cf82-431c-9da2-5a524fa46ed5","year":2015},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:57889ad198e088c0625b56a201bb7d929c7ca9c1b8cb98e6f793f914d2a3c5f8","observation_id":"ba6ac549-55bb-43ef-88a5-a7f605319028","resolution":{"observed_at":"2026-05-16T22:53:38.624357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:26739211136ae12044fbb060901bd5b63a6e86db4b049ab7789f0f8269c35860","observation_id":"2cbf090e-cb65-4f05-b66a-8f2ded4b9d0d","resolution":{"observed_at":"2026-05-16T22:53:38.240172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visualiz- ing data using t-sne.Journal of machine learning research","venue":null,"work_id":"9a48706d-cec4-49af-9c75-6b9302dd3206","year":null},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:43e3ea3c6693692a1052531021bff69275cb459642733d38a6a186c943f36e84","observation_id":"8f080c48-2655-46ee-86e2-371d59c29b0f","resolution":{"observed_at":"2026-05-16T22:53:38.612034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Snap video: Scaled spatiotemporal transformers for text-to-video synthesis","venue":null,"work_id":"942ea5d0-d110-4a5b-9e64-64cc7e1bea81","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:ee4904555297cfeff9aed34700cad5329e5481791a73b2fc98aee9ac388a26ee","observation_id":"d050ed4d-f63a-42da-b8bf-16b9b715b12a","resolution":{"observed_at":"2026-05-16T22:53:38.627376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SDEdit: Guided image synthesis and editing with stochastic differential equa- tions","venue":null,"work_id":"7c47ab1b-9542-45d4-b6b9-c0f4bbca7d48","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:fcc708c12dc187f735af9f4cdbf1d90f316dbd65add62583b528fd1b85f24c1e","observation_id":"cd02d8f1-21e7-4693-acb1-8d82f010d8ce","resolution":{"observed_at":"2026-05-16T22:53:38.479543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpt-4o.https://openai.com/index/ hello-gpt-4o/","venue":null,"work_id":"54e6995f-df3f-40c1-82a7-61292703a179","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:33038cd117a7555e81295bf3014f6503a48c78e9aaaeb2985a74e1b721f66225","observation_id":"2fc80446-f138-4cb1-8415-c98975fbc7ac","resolution":{"observed_at":"2026-05-16T22:53:38.506415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"af80435a-f2ba-4d08-ace2-b5f285352f6b","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:5d9484f0d37a4e1895df89de816e2124592bb6b157ecb54fefd0a2546797f28e","observation_id":"bb5a24e1-8e8f-4a96-8b04-b9090ea62411","resolution":{"observed_at":"2026-05-16T22:53:38.596484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic segmentation of outdoor panoramic images.Signal, Image and Video Pro- cessing","venue":null,"work_id":"d94141a6-faf2-43a5-b631-63c3493f49ac","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:0a0cce6488ff9c99c42ca1ca94bcea6be9fce4e596e1504d5b9ee0c409d34de1","observation_id":"459aa354-eeab-476a-a8bc-d1842970d7d9","resolution":{"observed_at":"2026-05-16T22:53:38.633324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"a6575fbd-6894-462c-be3e-926ca5f5bd97","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:659ad51fa6370a6c35ea2ce355c969aa7b768eb842ea20f8edd44b36cdab4212","observation_id":"5788af63-e56a-4118-bf72-2f6a0aaa44d8","resolution":{"observed_at":"2026-05-16T22:53:38.515780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16855","last_updated":"2025-03-09T02:57:28Z","snapshot_observed_at":"2026-08-07T22:08:49.929764Z","submitted_at":"2024-06-24T17:58:47Z","title":"DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation","version":2},"cited_work":{"arxiv_id":"2406.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16855","snapshot_observed_at":"2026-07-03T21:08:57.517878Z","title":"Dreambench++: A human-aligned bench- mark for personalized image generation","venue":null,"work_id":"07df1e79-a136-4532-b85e-ec5bd5030414","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2406.16855","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:11f562052c85e8d506534f6012f4974476e4e5ef1653a78b58c2d9982cc10eb9","observation_id":"244bcbdf-1cfc-43a9-b1c4-ae1cb2e22c9a","resolution":{"observed_at":"2026-05-16T22:53:38.282818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:ccad279eb9a062cbcf850fc1a96068af58fbf37e1573350a7709abc91daf9ff7","observation_id":"de4d2ea4-d615-46eb-9e5c-1920a1b47600","resolution":{"observed_at":"2026-05-16T22:53:38.303586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omni-id: Holistic identity represen- tation designed for generative tasks","venue":null,"work_id":"0076a3a9-61b9-4283-a91b-746174d92897","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b4328e2a54727bb74a37093cd160f2b1d9407cd60b2756f8d8403590dc63845b","observation_id":"95d8c6d0-25c4-4307-8444-400a9727df69","resolution":{"observed_at":"2026-05-16T22:53:38.608944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.18092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Composeme: Attribute-specific image prompts for controllable human image generation","venue":null,"work_id":"5d49e6ff-be09-4014-a836-0eaca863dbe9","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:4e86be23b80f0bd6b15bff37b409cf0a672ba2c167d9bcc6f50df5c4c5b6e524","observation_id":"9bd81b4b-7a08-452f-b253-1745c9a128bf","resolution":{"observed_at":"2026-05-16T22:53:38.285973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20820","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:58:32.692579Z","title":"Layercomposer: Interactive personalized t2i via spatially-aware layered canvas","venue":null,"work_id":"35e5e581-ebfd-49e3-9439-96e977ff389c","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:00552edd31c2d90c5a48d4e44a5804d2fdca842416992e1996cf17e51f0eb055","observation_id":"f675eb5a-cbba-4328-b4f6-d5556976fd15","resolution":{"observed_at":"2026-05-16T22:53:38.236417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"56a98f23-47ff-421f-8820-0ef2f55e7953","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:05ec7ffa3b8c393fd5cb66b23626bd67f663629df33034f73dfb98f7d5936a5e","observation_id":"330bcda7-cb81-4a61-91d1-4399e847e5f5","resolution":{"observed_at":"2026-05-16T22:53:38.577921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"1326d87d-e63d-4e09-bd2c-c7db2d5c3406","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6e65ca68607bd0e02fa5bbdd567e5c60819781d0bd1da74b481a24fe96872d17","observation_id":"39c29ea8-0bef-4fe0-9a1b-851cd9674207","resolution":{"observed_at":"2026-05-16T22:53:38.621292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Disentan- gling visual embeddings for attributes and objects","venue":null,"work_id":"31b48f76-04d0-4b5e-9a7d-5e4088dae531","year":null},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:8c56eb994c1148355522e5461c6e37c23340544a7f9d8835b7ee49d2eade9d91","observation_id":"4b82e551-d2e7-4cd2-8ae7-789cc4268ebf","resolution":{"observed_at":"2026-05-16T22:53:38.482541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instant- booth: Personalized text-to-image generation without test- time finetuning","venue":null,"work_id":"347925db-44ef-4cd2-b08f-9ddd2fcbb15a","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:647bb6ed244c2cdc31ecfcda5f8cd6ae930fa87b47a23c5570f7145310c94099","observation_id":"bc09e64f-106a-4d53-96ea-d78496dadf5a","resolution":{"observed_at":"2026-05-16T22:53:38.476193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.21228","doi":"10.48550/arxiv.2410.21228","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lora vs full fine-tuning: An illusion of equivalence","venue":"arXiv (Cornell University)","work_id":"64c35e8b-7441-4e1e-81d0-4c8b33204da6","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:fc0fd450d80ce1057bdfebdf294242abf453991c8c34de0deaa39c382e087218","observation_id":"8b9c0484-0adc-4eee-b673-e70173cf413d","resolution":{"observed_at":"2026-05-16T22:53:38.296739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6730a4c2ab5002b10896d0c11053e595ce6da77dfa3f27833e15301617434208","observation_id":"7e05af4e-9ee9-40f3-9e1c-d74cd159069c","resolution":{"observed_at":"2026-05-16T22:53:38.244109Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Saliency in vr: How do people explore virtual envi- ronments?IEEE transactions on visualization and computer graphics","venue":null,"work_id":"3d4c4baf-9f1b-4c67-add2-a182ac83e506","year":2018},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:263c584936077ebc7449720ad5804ce0df7314bbfef772c25dcc87a379733dab","observation_id":"ea23fe00-45aa-40bb-b116-d19e83632fa8","resolution":{"observed_at":"2026-05-16T22:53:38.488737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"05d305b3-cdb0-44f4-b488-453e0bb21c2d","year":2015},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b5f871d624a2995741ca662284933b82587d3bebf971f6ffbbcbb1bb9317b589","observation_id":"01e2d0ba-1b12-4d5e-a793-fcb680953cbc","resolution":{"observed_at":"2026-05-16T22:53:38.491642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":"2010.02502","doi":"10.48550/arxiv.2010.02502","metadata_source":"pith","pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Denoising Diffusion Implicit Models","venue":"cs.LG","work_id":"8fa2128b-d18c-405c-ac92-0e669cf89ac0","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:c61e9df8b1f551946fa8615cabfe8e2c9b33073c5a3838a0070a44d76044bc39","observation_id":"a4894817-927a-43aa-b672-26dc9839c7ac","resolution":{"observed_at":"2026-05-16T22:53:38.261587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"c4449511-f605-45bf-a4f4-369a8c9d6cf0","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:5003f5b1c361bf18f80c44c69820877c261e5192322bda8442e84a7e579bfc98","observation_id":"714f307d-6880-4b91-9cb7-d11b8934dd3c","resolution":{"observed_at":"2026-05-16T22:53:38.494505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need","venue":null,"work_id":"e24e7889-af48-4686-82d0-784bb7704b3b","year":2017},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:2c18d808b19fb4b15d17e4338f29b88ad5310ecc0ab4f1f728dde26db69889ac","observation_id":"97b68e3f-2efb-4ad1-8ba2-880b7432d50d","resolution":{"observed_at":"2026-05-16T22:53:38.533546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concept decomposition for visual exploration and inspiration.ACM TOG","venue":null,"work_id":"62a42ea5-5866-4670-a539-514d0f33ed8a","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:435c6dbcea662c2ff39607c147b64e7c6b0e1d3d7eeda712644073fc4ec433c6","observation_id":"a9560e6e-7ae4-4a53-a104-676925bc60c1","resolution":{"observed_at":"2026-05-16T22:53:38.602247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:c2618b7f95d752f8f5e5212804386fc6feac5c057500061c47c418721ed6a2ef","observation_id":"1f5b9b7e-6ac3-48c7-94a3-f851c242e8b1","resolution":{"observed_at":"2026-05-16T22:53:38.307591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chi, Quoc V","venue":null,"work_id":"292ba01d-1a74-40b8-8472-efd8769bdc10","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:27650c327b47ddfd67f4643364a4f92ffce9445631358c0fd739ee7371511ba6","observation_id":"e5b313a4-8361-4b19-8787-61bd7a16566b","resolution":{"observed_at":"2026-05-16T22:53:38.518733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:1dc36486bd5b978cdeff10aabbcdc6e14062f749973e45e43f0ed7d2eadd7181","observation_id":"0be264ba-085e-478d-b4dd-3f166f323722","resolution":{"observed_at":"2026-05-16T22:53:38.300363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06679","doi":"10.48550/arxiv.2510.06679","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dreamomni2: Multimodal instruction-based editing and generation","venue":"ArXiv.org","work_id":"caa956fb-4bc6-4cba-ab91-329773bba8a1","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:76ef1f4aa661a440577463520d0349f3ea15a759db8aa976b490c978f8b11203","observation_id":"82be4064-a224-49e9-b72f-b33182f31d66","resolution":{"observed_at":"2026-05-16T22:53:38.254743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnigen: Unified image genera- tion","venue":null,"work_id":"4791d197-0d6c-49d1-a26a-2352420aaba2","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:eb1c15d66282dfdc08217785b6a428ff3aaf40de1ae3026b53d1fb8051ef3266","observation_id":"a613e3eb-e283-4b70-bfce-fbc5c2980317","resolution":{"observed_at":"2026-05-16T22:53:38.599352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02206","last_updated":"2025-03-04T02:36:48Z","snapshot_observed_at":"2026-08-07T22:08:48.424165Z","submitted_at":"2025-03-04T02:36:48Z","title":"Language-Guided Visual Perception Disentanglement for Image Quality Assessment and Conditional Image Generation","version":1},"cited_work":{"arxiv_id":"2503.02206","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.02206","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language-guided visual perception dis- entanglement for image quality assessment and conditional image generation","venue":null,"work_id":"1dfe0f4a-45fd-4de9-bc67-23c5be5633d4","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2503.02206","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:77f5c7621182335b7f4c61f0386807f223a5c0a753d235188d7730d93dadfbfb","observation_id":"8bd2d86a-179d-43f3-bf5a-1f73c4c8f3f9","resolution":{"observed_at":"2026-05-16T22:53:38.258446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.06721","doi":"10.48550/arxiv.2308.06721","metadata_source":"pith","pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"98e51b10-54bd-4251-8a2d-f79bd6215c19","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:19bad01a43e206aa274191df689d9146f339e2d2a4b88f201aae5cf16079a8a3","observation_id":"cda984eb-911b-419d-8101-fc2338d5b41c","resolution":{"observed_at":"2026-05-16T22:53:38.247542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"f81580f0-2b16-4b7f-80ec-5ff83a1c6c1a","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:017fd531292ec72b868945f281b16e07085b9cf74d99ea7c448e917020b9456f","observation_id":"b5e5538f-d825-48b0-89e6-ccdc96bb626b","resolution":{"observed_at":"2026-05-16T22:53:38.497277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A fixation-based 360 benchmark dataset for salient object detection","venue":null,"work_id":"22cb0f0f-03d4-4f80-baf3-6ba58b573632","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:ab8d4448f92befd46ab37798439424ab794717552ff167d769870eb60d5b87c5","observation_id":"8f4a0a93-befd-4e33-b3a7-c2b89b62f30f","resolution":{"observed_at":"2026-05-16T22:53:38.503231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11277","last_updated":"2023-09-12T16:28:00Z","snapshot_observed_at":"2026-08-01T19:01:47.393546Z","submitted_at":"2023-04-21T23:52:27Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","version":2},"cited_work":{"arxiv_id":"2304.11277","doi":"10.48550/arxiv.2304.11277","metadata_source":"pith","pith_arxiv_id":"2304.11277","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","venue":"cs.DC","work_id":"bee7755e-b855-401d-813a-06ae9451d768","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2304.11277","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b9efff2738f62258e9ddad567890e15825411efab455e6ec3b367a8bf7c60077","observation_id":"fa9d6c83-3baa-4219-896c-a82c8b9635fc","resolution":{"observed_at":"2026-05-16T22:53:38.251173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:13.496008+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:13.496008+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.18612","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T19:26:00.768643Z","title":"person identity","venue":null,"work_id":"706e532c-2a94-4f97-8299-48ba337966c5","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:cd442a0a1f0c92cb599cbc9c798a6ca1c27adb0d9ffa0e383e5a60629e8925c3","observation_id":"ec9ac1c9-84d6-48f9-8219-ac02f4a241b1","resolution":{"observed_at":"2026-05-16T22:53:38.265681Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T18:59:53.204146Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":19,"verified_fuzzy":53},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 1 inbound Pith citation observation for arXiv:2512.10955."}