{"as_of":"2026-08-10T05:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cd1eb3f22d6c887be6bde5f74a2a9ab972aa5bdbc49ff18924f210fcaf2127dd","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:44:00.325185Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T15:11:57.228949Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T15:17:07.293578Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2604.05393","last_updated":"2026-04-07T03:43:01Z","snapshot_observed_at":"2026-07-06T22:54:08.897942Z","submitted_at":"2026-04-07T03:43:01Z","title":"Beyond Semantic Search: Towards Referential Anchoring in Composed Image Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T19:42:23.224746Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2604.05393"},"observation_digest":"sha256:f3a95a41e8844e8f143b0a6e3e17d5dfed5a66b46151e4c64caa1d4145e6c04b","observation_id":"62f33b34-ac4b-4a13-afc3-b858cd40f836","resolution":{"observed_at":"2026-05-10T22:35:50.487903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2604.09114","last_updated":"2026-04-10T08:50:47Z","snapshot_observed_at":"2026-07-06T22:58:04.106299Z","submitted_at":"2026-04-10T08:50:47Z","title":"FIRE-CIR: Fine-grained Reasoning for Composed Fashion Image Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:25.983511Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2604.09114"},"observation_digest":"sha256:3889708eff9944ac669b9cb51ab17ec16869cc7e8ae17fde11c8c85c11baf984","observation_id":"bd154788-16db-4ba3-92d1-516fb324fc4e","resolution":{"observed_at":"2026-05-11T05:21:00.335945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2606.30217","last_updated":"2026-06-29T12:30:24Z","snapshot_observed_at":"2026-08-03T23:12:01.383471Z","submitted_at":"2026-06-29T12:30:24Z","title":"Before Thinking, Learn to Decide: Proactive Routing for Efficient Visual Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T05:55:19.083517Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2606.30217"},"observation_digest":"sha256:47ef734be80ec579a18a84c969e0b6eed1b3616abc2166dc58497e4c0566bc2d","observation_id":"3187ab66-df64-4504-9f9a-022ebd5919aa","resolution":{"observed_at":"2026-06-30T13:34:41.178587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2607.00374","last_updated":"2026-07-01T03:20:06Z","snapshot_observed_at":"2026-08-07T17:15:46.303275Z","submitted_at":"2026-07-01T03:20:06Z","title":"Learning to Compose: Revisiting Proxy Task Design for Zero-Shot Composed Image Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-02T15:11:57.228949Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2607.00374"},"observation_digest":"sha256:f3cf57a25787be062a2759a43e29ec588977b3c79fdef01699564d80c417b013","observation_id":"dde27b49-0cd2-40f4-8b20-4e4842d4db26","resolution":{"observed_at":"2026-07-02T15:17:07.294917Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17796/citation-record","integrity":"/paper/2505.17796/integrity","json":"/paper/2505.17796/citation-record.json","paper":"/paper/2505.17796"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:53.147868Z","title":"Composing text and image for image retrieval-an empirical odyssey","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.147868Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:7107f12ef287335e1935a7630f44f600cb63e062ef717f191691f477f6fd9c69","observation_id":"c3f745a7-6620-4930-a497-26cd3de8e8cb","resolution":{"observed_at":"2026-08-07T14:43:53.147868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:53.269842Z","title":"Image retrieval on real-life images with pre-trained vision-and-language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.269842Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:0c5a943ceb87f1a1a0eb59eb8283284d1754bd2d718a45325ff4d5026925a1ed","observation_id":"050ff53f-ca7e-4e67-8a9c-6e18af744329","resolution":{"observed_at":"2026-08-07T14:43:53.269842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:11.281115Z","title":"Deep image retrieval: Learning global representations for image search","venue":null,"work_id":"6d37c00b-2ddf-449d-9d26-380d2816728d","year":2016},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.412796Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:03ba21311f2579af40e8ef66dba13d151196f41574e60d887812307208ea6e30","observation_id":"09ffaa7a-d00b-4ccb-9332-09ad7fb1d5ae","resolution":{"observed_at":"2026-08-07T14:44:11.378843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:11.025257Z","title":"Large-scale image retrieval with attentive deep local features","venue":null,"work_id":"9c0a7755-5ac4-46cf-9600-45ed6359b6f1","year":2017},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.497335Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e08ed50d5ff4b95366e92ab4c7afd2aa7036c1dfa40436b81e5be4df89f0ae79","observation_id":"9a064fdf-4ce3-4d1f-92eb-5bcfa52d337e","resolution":{"observed_at":"2026-08-07T14:44:11.156029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.784899Z","title":"Camp: Cross- modal adaptive message passing for text-image retrieval","venue":null,"work_id":"00a411fa-93f3-470c-87f0-a98c680af359","year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.615652Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:236e519e9a79b7a9853f937ce0e54fc9270492be4f7bbbe38a2f782f36e1e056","observation_id":"df64123b-daf0-4580-8900-7292ea28ee06","resolution":{"observed_at":"2026-08-07T14:44:10.902901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.584424Z","title":"Context-aware attention network for image-text retrieval","venue":null,"work_id":"63eb1a03-7d0f-4d09-bde2-22b4083af4f8","year":2020},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.731224Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:dc55578c39bf117aadca00bf882aed8ee0680c6683cd7df4c4caa403dab91885","observation_id":"b9a9b2aa-5d4d-4ded-89ce-fdac6a4ff7de","resolution":{"observed_at":"2026-08-07T14:44:10.680723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.409230Z","title":"Image search with text feedback by visiolinguistic atten- tion learning","venue":null,"work_id":"6859ffcc-3194-4426-8bd5-3872b3ca78e7","year":2020},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.829475Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:17f45e9ded7d3a4f674f5a865894797762ab58b7b4cfd3f32273390047e7ceca","observation_id":"e40c7bdc-7a53-4429-8f9c-121747b9f438","resolution":{"observed_at":"2026-08-07T14:44:10.485470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:53.907146Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.907146Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:48fc4e34ba7bb68b7ad3abff8209b4c285a8b449ec390058e48ba71a6af7d0ac","observation_id":"eca6e02a-5b37-4837-a57e-122b1ee06f1c","resolution":{"observed_at":"2026-08-07T14:43:53.907146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.016817Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.016817Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:29fe7c1918bb978641356adaa3f21bcf1390ae9e7ae79a0fc644c6225e3a820a","observation_id":"41253191-9e28-4fa7-8213-7b26ecefd9c9","resolution":{"observed_at":"2026-08-07T14:43:54.016817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.068697Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.068697Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:fbf6f405b8122ed4a96b45d66a8848e4725878fd760e5928aa98952ff4dca328","observation_id":"5d48ad48-aacb-441a-b19b-c54f3fbf265c","resolution":{"observed_at":"2026-08-07T14:43:54.068697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.122955Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.122955Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:527dd383f6dacae240aae90d5527d70d8dc1dab711a84c1a33b83db2da0434ae","observation_id":"f5b3f5c2-4c71-4ebf-822e-43d7f07f96a0","resolution":{"observed_at":"2026-08-07T14:43:54.122955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.199416Z","title":"Artemis: Attention-based re- trieval with text-explicit matching and implicit similarity","venue":null,"work_id":"c3da5d22-9526-40df-85c8-4e4911c1bbb4","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.185826Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:70c74f3953aa58bd43ad00365ec70975488ce3e5d4863c6d4b15c18bf4697ff1","observation_id":"63dc7c68-34fa-4156-afdc-b72d22a0e176","resolution":{"observed_at":"2026-08-07T14:44:10.292713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.046388Z","title":"Compositional learning of image-text query for image retrieval","venue":null,"work_id":"48cdb9c6-8a18-482b-956e-eb39107908e0","year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.278775Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:d4492dfe8b0c0eb2242288159b0b1a58e1993b4f6e0d3458a2ad9cba61d89ed2","observation_id":"dfbcde8f-8345-4f90-9279-b91d1d312b02","resolution":{"observed_at":"2026-08-07T14:44:10.107308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.388946Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.388946Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:2ac37c41b3ca9dfabc75b6a07e420c7a9fce4c0030a6f0d47af2435eb8356ebe","observation_id":"eec2f1eb-4ae4-4b12-a5cb-d5148253ba81","resolution":{"observed_at":"2026-08-07T14:43:54.388946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.880307Z","title":"Spirit: style-guided patch interaction for fashion im- age retrieval with text feedback.ACM Transactions on Multimedia Computing, Communications and Applications, 20(6):1–17, 2024","venue":null,"work_id":"81b4b6e3-441a-47f9-b997-0cbd6423a360","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.455210Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e537910874248f0b004ef00d83ec6daf29e0476523c717e5c831fc17da287988","observation_id":"30b41aeb-4385-42fe-8031-3d77e162324d","resolution":{"observed_at":"2026-08-07T14:44:09.949637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.687622Z","title":null,"venue":null,"work_id":"9106285e-b2d3-4ed7-908a-bb8a9ccb0ce3","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.589003Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:31ac3e937053695ca3ffadfb5ab94c6e7eebd7478bdc4ba385a5fb77a7f99a21","observation_id":"7e91d982-7f84-42ca-b060-229d6096fe38","resolution":{"observed_at":"2026-08-07T14:44:09.775330Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.518154Z","title":"Data roaming and quality assessment for composed image retrieval.Proceedings of the AAAI Conference on Artificial Intelligence, 38(4):2991–2999, Mar","venue":null,"work_id":"edc17c95-f61a-4eab-94a0-653f168f531e","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.700670Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:3ece61fdb50e2dde1d8b1d8921e6ec64fd638832643eedafed27d7d89d17be6b","observation_id":"9d37f5e2-7296-4096-9a8b-9fa45cc6c8c2","resolution":{"observed_at":"2026-08-07T14:44:09.584047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.325535Z","title":"Candidate set re-ranking for composed image retrieval with dual multi-modal encoder.Transactions on Machine Learning Research, 2024","venue":null,"work_id":"f55c48cd-8a9a-4a16-a905-46bbd391ff02","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.766710Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:70441b5044fb4f7eef4c87a0861e6f2a6a6e86aa54dda50b6a86f0153c5de60e","observation_id":"bf4a2ef7-7d93-4c1d-8141-bed5f2f3f566","resolution":{"observed_at":"2026-08-07T14:44:09.416048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.145768Z","title":"Simple but effective raw-data level multimodal fusion for composed image retrieval","venue":null,"work_id":"35de9efa-db5e-4a32-9303-ba1ab1693930","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.885737Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:319f1ec58c49898adccb28ce6f8c3171587354642515acee300a9e70fae2848d","observation_id":"6b45d603-4760-4bbb-86b8-4a9a214e2a85","resolution":{"observed_at":"2026-08-07T14:44:09.252934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.879335Z","title":"this is my unicorn, fluffy","venue":null,"work_id":"430eaf7f-d6e2-43f2-b84b-5d503eb80204","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.038721Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:065786b16de851da86baed2a5b8492f99a24acbfb42dc4a3ea377e94f3246666","observation_id":"0c5092be-8b19-487b-9bfd-f6b5064c6466","resolution":{"observed_at":"2026-08-07T14:44:09.005365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:55.237440Z","title":"Effective conditioned and composed image retrieval combining clip-based features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.237440Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:8c1b577579ab0f2dd8c77d8318702892ae256e3ccdd51e81bd514159f285fed3","observation_id":"4705c3f5-524a-4506-b776-e98cb064e6fc","resolution":{"observed_at":"2026-08-07T14:43:55.237440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.588921Z","title":"Pic2word: Mapping pictures to words for zero-shot composed image retrieval","venue":null,"work_id":"e4c057b9-6bf7-42b6-980d-c3efb7b8fced","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.358238Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:cd24b2ab909033df253cb222b81b14ba320c373e8e47a55b6206f4247cebbca5","observation_id":"5bef2185-90b5-4f09-93f3-984e675cc7e1","resolution":{"observed_at":"2026-08-07T14:44:08.744475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.406831Z","title":"Zero-shot composed image retrieval with textual inversion","venue":null,"work_id":"2d450777-bfd9-4978-87ef-a1848e308ec2","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.500840Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:6be36ce3cb0bb43cf983d322eedeec903b987f866c7c25691aefef99ab5b33b5","observation_id":"8ff4bb9f-ec19-421b-a7fd-8d53d2280d3f","resolution":{"observed_at":"2026-08-07T14:44:08.475036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.215252Z","title":"Sentence-level prompts benefit composed image retrieval","venue":null,"work_id":"fc70910d-6214-4e10-a8ff-401bff254754","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.635822Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:c7c6401ee7afba2bb06ccfc6d71973a8221a95efae8169b6b693d5f548cd7e43","observation_id":"c82aea50-fd75-42eb-a2da-79d6da7a2658","resolution":{"observed_at":"2026-08-07T14:44:08.311428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.995990Z","title":"Covr: Learning composed video retrieval from web video captions.Proceedings of the AAAI Conference on Artificial Intelligence, 38(6):5270–5279, March 2024","venue":null,"work_id":"317bddcf-5e7b-4275-8e0a-4fd28fdf9bc2","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.794370Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:227b7d895155b5b7677dc0f28c1f7fe393f317eed7cbc2dcea0d6b15d2847b21","observation_id":"57ee9fc1-2ec6-4341-a272-be189cd3326a","resolution":{"observed_at":"2026-08-07T14:44:08.114923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.644069Z","title":"MagicLens: Self-supervised image retrieval with open-ended instructions","venue":null,"work_id":"6aaf227a-79ac-4d1b-bcc5-38c628d24d87","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.934833Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:dccd4441108848b299f262fa0e41b601af434ad2e8bcf32c4353f9c02f321c83","observation_id":"4f361353-6858-4db8-923d-26c109fb6067","resolution":{"observed_at":"2026-08-07T14:44:07.784156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.381930Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering","venue":null,"work_id":"63da70a1-d9fb-4945-b341-60dd2bb1a2b6","year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.051137Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:b88bfc5d537052609f2f3d9e1a917ca8bbed1e63efe29b08e496f31a2542aae5","observation_id":"8bc47e73-4f3b-4b83-a68d-7b5af92096db","resolution":{"observed_at":"2026-08-07T14:44:07.509690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:56.175702Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.175702Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:f8c49ad41272f859a42d0bff6070aa00600832fc5aab0c11fc1db8b8b3be6f3a","observation_id":"6d177c37-97d5-49ad-949a-6b3d9b04378e","resolution":{"observed_at":"2026-08-07T14:43:56.175702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:43:56.316244Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.316244Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:7af2da9f2c5ec3e956f8fc5bd62b40980c28c250e464c613b6e1a4edd657897d","observation_id":"83cf44a5-0591-4a16-a258-32d7a3260653","resolution":{"observed_at":"2026-08-07T14:43:56.316244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T14:43:56.455799Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.455799Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:3505b2fff0caee2248334dd779d87c4a3845b2da3bb88e563669e3eab7efad0f","observation_id":"630cfc92-f64d-4f65-9c26-bdfa921a6ed0","resolution":{"observed_at":"2026-08-07T14:43:56.455799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:56.577771Z","title":"Compodiff: Versatile composed image retrieval with latent diffusion.Transactions on Machine Learning Research,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.577771Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:324555e6ceb3a1ad2a65368eb04bd67463fdd5c454d66a31d703f82a47c67ee6","observation_id":"e00ec1cb-cbf8-4422-93e4-c61ec0fef7dc","resolution":{"observed_at":"2026-08-07T14:43:56.577771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.072535Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"7a5cf9e7-b0ef-4022-9a72-61857f498df8","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.904411Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e85f7129f48104f19d0bd191fd423c53a9a69a7f1767d1ccf2451a9aedf3157c","observation_id":"62ef6ebe-4e50-4030-9fe6-afae34d8bb0f","resolution":{"observed_at":"2026-08-07T14:44:07.190195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:06.778015Z","title":"Fashion iq: A new dataset towards retrieving images by natural language feedback","venue":null,"work_id":"e2da2585-e41d-459f-8157-64eb8e2170a7","year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.050870Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:8080e4cbf7fd3aa6adab94011330c44dbce82b974c42a97a8e64f07e43438a7f","observation_id":"7518d2ea-7e47-4bc9-90ec-e6952ea00660","resolution":{"observed_at":"2026-08-07T14:44:06.920687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:06.481228Z","title":"A corpus for reasoning about natural language grounded in photographs","venue":null,"work_id":"f200d6a9-1538-4859-91d6-8844544573d1","year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.273543Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:1eaf48e9ef4f9898a7a6778643d6872d101b4cf43bf5048f1734db5e57395caa","observation_id":"b569a896-eb21-4114-8646-8d7661c07db1","resolution":{"observed_at":"2026-08-07T14:44:06.634343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:06.180100Z","title":"Eva: Exploring the limits of masked visual representation learning at scale","venue":null,"work_id":"b035c48d-ed2c-4e4f-b483-537b285d53c3","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.397727Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:165ae736170658583712cd5ee4fed018931885e9d06ce86db51ec0ed3c41844c","observation_id":"713d6b88-8a7f-4149-92f8-19308f895bff","resolution":{"observed_at":"2026-08-07T14:44:06.339458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T14:43:57.512568Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.512568Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:ab149318963516b86b9997ef8d45ae28231a3ac03ecc7d9c8b8f64f1fe3198ec","observation_id":"f1c98d48-8b23-4cb3-a918-c33d820ce731","resolution":{"observed_at":"2026-08-07T14:43:57.512568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.883686Z","title":"Improving composed image retrieval via contrastive learning with scaling positives and negatives","venue":null,"work_id":"aa5b1413-80fc-46da-9671-266a4380a07c","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.612935Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:8060a02f4b13cdf338d9413cef2f2b75594b78dc0a5b120a52948dee1efd3259","observation_id":"0626241b-c2fe-4f60-b165-22bf43f4fc91","resolution":{"observed_at":"2026-08-07T14:44:06.005802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.506594Z","title":"Decomposing semantic shifts for composed image retrieval","venue":null,"work_id":"a35cbc30-56d4-42e8-97e4-e1d8838fcc12","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.725883Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:d6d70588c754cda22ed13f0fcc09f3dfb2b9244d3c2973b78bf26682a6fb0b51","observation_id":"73eff5d1-aa2a-49d8-a950-2a06c215fde0","resolution":{"observed_at":"2026-08-07T14:44:05.695708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.224877Z","title":"Bi-directional training for composed image retrieval via text prompt learning","venue":null,"work_id":"3fcda66f-39f9-4a86-9b77-821063c1ff60","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.813362Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:7a267714edb7307865c80c6d2cedff330e1b9055e5914d4fe44575e0f0253c8e","observation_id":"9e201731-d041-4d34-9878-a5bd87a2fff5","resolution":{"observed_at":"2026-08-07T14:44:05.326598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.017109Z","title":"Cala: Com- plementary association learning for augmenting comoposed image retrieval","venue":null,"work_id":"f2336c7b-45e6-4587-9166-8d1f028d11ca","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.875776Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:b6238e818c0a4dff97f3f6afb06e9988be2aad39cbdb39082aa97043abee6e58","observation_id":"e204848b-a8ae-488c-b4b8-dbc49a6a05fe","resolution":{"observed_at":"2026-08-07T14:44:05.111600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:04.723957Z","title":"Target-guided composed image retrieval","venue":null,"work_id":"5f74333f-5713-49f0-9a8f-f0932222ddbe","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.013676Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e500c84e5e16bade48dbcf15e4f68859fffa6a2292997ae8dd95e87f9bbd9347","observation_id":"45f2fad1-e1a1-41a9-9e02-6e7652674d11","resolution":{"observed_at":"2026-08-07T14:44:04.904786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:04.449163Z","title":"Leveraging large vision-language model as user intent-aware encoder for composed image retrieval","venue":null,"work_id":"ae387060-53bd-4237-b836-8f18ac86abe0","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.099612Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:fe83fd72683d1b64ebd3ad9470e87e04c78aa0f05487f6000da38f44d6aa0410","observation_id":"de3a0295-83de-460a-81ed-7e1e94bc366e","resolution":{"observed_at":"2026-08-07T14:44:04.600295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:04.244360Z","title":"Ccin: Compositional conflict identification and neutralization for composed image retrieval","venue":null,"work_id":"94deda1c-9434-4a8d-a33a-d116b2e23e0f","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.214233Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:fd69664bfef57d246c31300746cf10371734e0a5c177cb92aa01d38abd5f4bff","observation_id":"abb99c63-a3bb-4a32-872d-132a9da6a7fc","resolution":{"observed_at":"2026-08-07T14:44:04.341700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.992801Z","title":"Conditioned and composed image retrieval combining and partially fine-tuning clip-based features","venue":null,"work_id":"e1f4547f-1e88-4bd8-8436-afdf159cb768","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.309122Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:7db16016a9f00319196b834fd4b446d7e247881e9f17da2770e0c9bc73abca8e","observation_id":"fa910af5-3346-45c4-a797-eebd6c4a1a32","resolution":{"observed_at":"2026-08-07T14:44:04.124887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.814486Z","title":"Few-shot composition learning for image retrieval with prompt tuning","venue":null,"work_id":"b046a4fa-001b-4459-bcb8-51fe45217f18","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.426884Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:0f04b6f8e376cfabcfa44a350d5f347a68f076c936bc00ede8a5cb16d75608cf","observation_id":"09b9aa1c-3148-4543-ab08-26717d73374d","resolution":{"observed_at":"2026-08-07T14:44:03.886221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.556394Z","title":"Multi-modal transformer with global-local alignment for composed query image retrieval.IEEE Transactions on Multimedia, 25:8346–8357, 2023","venue":null,"work_id":"bcf01e7d-8753-4cfc-82e0-39f6efd2b88f","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.529594Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:69685b3583724e8fce9a1ac2a931d592980c5e139ec97e3a41e1ea2b495cc77e","observation_id":"0fc97d0d-4410-4529-ad8c-65a6780661de","resolution":{"observed_at":"2026-08-07T14:44:03.670750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.338732Z","title":"Negative-sensitive framework with semantic enhancement for composed image retrieval.IEEE Transactions on Multimedia, 26:7608–7621, 2024","venue":null,"work_id":"745079d0-4299-4896-803a-649a608f9850","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.638400Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:80606463de34988e7edeec650357a75d949802ee9bab178cead5f7f5e217297c","observation_id":"2bbcb864-4f2c-4c57-a354-4a7717ff6e83","resolution":{"observed_at":"2026-08-07T14:44:03.405453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.107622Z","title":"Collaborative group: Composed image retrieval via consensus learning from noisy annotations.Know.-Based Syst., 300(C), November 2024","venue":null,"work_id":"228cb3eb-ebe5-4df5-89db-ef9daa869b26","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.712930Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:56794fb651d83c2c26ba9efc2bd4a8cfc44695b20c838da00aa57f037896df1e","observation_id":"47c2e41f-f78a-4195-a321-dfbdb6cae9e8","resolution":{"observed_at":"2026-08-07T14:44:03.202885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06001","last_updated":"2024-11-12T15:14:41Z","snapshot_observed_at":"2026-07-06T18:43:05.700263Z","submitted_at":"2024-07-08T14:53:07Z","title":"Pseudo-triplet Guided Few-shot Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":"2407.06001","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.06001","snapshot_observed_at":"2026-08-07T14:44:00.737636Z","title":"Pseudo-triplet Guided Few-shot Composed Image Retrieval","venue":"cs.CV","work_id":"f8820334-5743-4543-b07d-ad7149dae7cc","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.819184Z"},"links":{"cited_paper":"/paper/2407.06001","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:87476c3888f90c5a6a13847ad6989b958d8df1cd5d8a988bdcfa2f1fe8e444fb","observation_id":"c4d06de3-3b1b-4a24-bd20-993fff0a405b","resolution":{"observed_at":"2026-08-07T14:44:00.833866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.923092Z","title":"Vqa4cir: Boosting composed image retrieval with visual question answering","venue":null,"work_id":"f2fd6ed3-64d6-4603-ba5e-61aa203fa353","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.924199Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:1738a11ae9fc5569ffd480dc889c975cdbdf6d94a25b501fc6799df86db2456e","observation_id":"26a671d1-1f42-42d1-94a7-b065f3b4e3d3","resolution":{"observed_at":"2026-08-07T14:44:02.980271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21309","last_updated":"2025-03-27T09:34:21Z","snapshot_observed_at":"2026-08-07T16:33:24.726393Z","submitted_at":"2025-03-27T09:34:21Z","title":"FineCIR: Explicit Parsing of Fine-Grained Modification Semantics for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21309","snapshot_observed_at":"2026-08-07T14:43:59.017726Z","title":"Finecir: Explicit parsing of fine-grained modification semantics for composed image retrieval.arXiv preprint arXiv:2503.21309, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.017726Z"},"links":{"cited_paper":"/paper/2503.21309","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:d995f94932d75c17a0414ebcf1cb5b1f330d44878508114447a8162ddcdc66c8","observation_id":"772e0a21-3533-4e85-8e31-0d4eb9e10ad9","resolution":{"observed_at":"2026-08-07T14:43:59.017726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-07T14:43:59.111384Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.111384Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:8172e195ff07e935a779529570dd3321ff5fd7dff6762775adbb5565c6812a69","observation_id":"80a03846-8f31-4db0-a824-3356847631c0","resolution":{"observed_at":"2026-08-07T14:43:59.111384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.672474Z","title":"Knowledge-enhanced dual-stream zero-shot composed image retrieval","venue":null,"work_id":"6b938a87-cf5d-484e-b906-e7f5f8f6ec0e","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.192994Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:a1d67c51e1b9e285fe61eabde9ef39d1fef0c01888fe87288f292f5fd1a0b495","observation_id":"67f32931-9266-4381-8bc8-431c18972396","resolution":{"observed_at":"2026-08-07T14:44:02.797198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.374622Z","title":"Ldre: Llm-based divergent reasoning and ensemble for zero-shot composed image retrieval","venue":null,"work_id":"ec1d30c8-3716-4c5d-a81c-8404c3fa8eeb","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.280809Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:fdf674d75333663dde8ad43809704cb82ed69f70909a59574c3eb8defbc3f39f","observation_id":"5ffbfd32-a300-4691-8c1a-9c45e22790da","resolution":{"observed_at":"2026-08-07T14:44:02.506820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.070993Z","title":"Semantic editing increment benefits zero-shot composed image retrieval","venue":null,"work_id":"a1655c77-e8c5-405d-9bdd-d0c2eeffb202","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.371617Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:5636c65feb8aa786b2bf049b9b42feed690687373334b3fd990ba49f646f0693","observation_id":"8a56a2f1-b974-407a-ba18-6e51006b2f95","resolution":{"observed_at":"2026-08-07T14:44:02.240291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09291","last_updated":"2024-02-26T18:59:49Z","snapshot_observed_at":"2026-08-08T20:12:12.510339Z","submitted_at":"2023-10-13T17:59:38Z","title":"Vision-by-Language for Training-Free Compositional Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09291","snapshot_observed_at":"2026-08-07T14:43:59.484503Z","title":"Vision-by-language for training-free compositional image retrieval.arXiv preprint arXiv:2310.09291, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.484503Z"},"links":{"cited_paper":"/paper/2310.09291","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:a8e73547b727fc6a04cc571a6c71cdf3e1411caf914cd86f3ca03e57671f87dd","observation_id":"703b7aba-149f-44df-9c13-06255edc21b9","resolution":{"observed_at":"2026-08-07T14:43:59.484503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18495","last_updated":"2025-03-04T15:16:52Z","snapshot_observed_at":"2026-08-07T18:06:56.322892Z","submitted_at":"2025-02-19T01:37:24Z","title":"A Comprehensive Survey on Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":"2502.18495","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.18495","snapshot_observed_at":"2026-08-07T14:44:00.508748Z","title":"A Comprehensive Survey on Composed Image Retrieval","venue":"cs.MM","work_id":"1aa65162-0351-46c7-868f-ab2fd47a0f3a","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.614237Z"},"links":{"cited_paper":"/paper/2502.18495","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:1c9d051e07d89dc10dd8156877877534dfa86f71db5c70d9c98b67ccafda4d49","observation_id":"06229b1f-0c8f-4221-aedc-b2a67d74340a","resolution":{"observed_at":"2026-08-07T14:44:00.614106Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00145","last_updated":"2020-06-30T22:55:02Z","snapshot_observed_at":"2026-08-10T04:19:10.277774Z","submitted_at":"2020-06-30T22:55:02Z","title":"Modality-Agnostic Attention Fusion for visual search with text feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00145","snapshot_observed_at":"2026-08-07T14:43:59.708865Z","title":"Modality-agnostic attention fusion for visual search with text feedback.arXiv preprint arXiv:2007.00145, 2020","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.708865Z"},"links":{"cited_paper":"/paper/2007.00145","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e2f26a9ad11a42be59dfe6f80b301ddab63e6398ca76adc6ebaa45e344d34f7b","observation_id":"0ac25f3e-b83d-4c79-a872-74146f2e3f59","resolution":{"observed_at":"2026-08-07T14:43:59.708865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.799724Z","title":"Cosmo: Content-style modulation for image retrieval with text feedback","venue":null,"work_id":"aacad22b-abd6-4299-9bce-3745de15ff2f","year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.822245Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:4acd6149026830d915ef9d515af6ebc3532e738bf7ae4359463d7316eb5ba6fe","observation_id":"a6d9ad5f-e31f-4fb9-bdd4-e2bb91c63319","resolution":{"observed_at":"2026-08-07T14:44:01.918365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.592368Z","title":"Fame-vil: Multi-tasking vision-language model for heterogeneous fashion tasks","venue":null,"work_id":"1e032c76-33d6-4ac4-9d90-44426e07ea94","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.927882Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:10be9e7f9cd0e2df39f418314560aa1ce4993730b2bcd6934b6d33290ba701a5","observation_id":"911ef9e2-5ed9-4ecb-8076-f625388f2885","resolution":{"observed_at":"2026-08-07T14:44:01.674657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.346760Z","title":"Composed image retrieval with text feedback via multi-grained uncertainty regularization","venue":null,"work_id":"5b793b78-f002-4d0f-ae7c-924c8f158f9c","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.032163Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:f8b25938195ffde74e98b2bad2e1e9665192b5599d5d0dc721c60362871f6cc3","observation_id":"51debe43-6489-439b-bf22-41e80531f186","resolution":{"observed_at":"2026-08-07T14:44:01.439682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.159511Z","title":"Genecis: A benchmark for general conditional image similarity","venue":null,"work_id":"9661cf3c-c338-482a-ae37-75036d703580","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.115285Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:2990366e4f0fbf62255f85f92fa719bd675a3107742cd4aaf2ec287459b10ae8","observation_id":"9e93f219-e6a6-4c75-a46b-902f76e144c3","resolution":{"observed_at":"2026-08-07T14:44:01.261547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:00.981155Z","title":"Language-only training of zero-shot composed image retrieval","venue":null,"work_id":"151b1223-4676-48bf-bf5e-9f6362c7e0da","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.208920Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:39d873f6603abbd503b1a409c2be794bc1400682a3b21bf2925d560d334c8b78","observation_id":"36cc717f-0d3d-4ff3-a4c7-10f92ad5a3d4","resolution":{"observed_at":"2026-08-07T14:44:01.056423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17109","last_updated":"2025-03-30T12:19:03Z","snapshot_observed_at":"2026-08-07T16:46:41.665183Z","submitted_at":"2025-03-21T12:49:50Z","title":"Missing Target-Relevant Information Prediction with World Model for Accurate Zero-Shot Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17109","snapshot_observed_at":"2026-08-07T14:44:00.325185Z","title":"Missing target-relevant information prediction with world model for accurate zero-shot composed image retrieval","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.325185Z"},"links":{"cited_paper":"/paper/2503.17109","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e6b093e099f8c1d58239d46dabe6983191d083ad204a0e94a8d37e6b59f644b9","observation_id":"8a3e7ba4-27b1-44f9-892f-21eba2dee7eb","resolution":{"observed_at":"2026-08-07T14:44:00.325185Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:56.707152Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.707152Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:75f891a8de9c30c57a3e87a48fadb69a82beeb2648be23e49c1b36507f64fc14","observation_id":"f154ed0a-03cc-4ea0-838d-357fdb610286","resolution":{"observed_at":"2026-08-07T14:43:56.707152Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T01:34:45.337180Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":18,"verified_exact":2,"verified_fuzzy":43},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 4 inbound Pith citation observations for arXiv:2505.17796."}