{"as_of":"2026-08-10T12:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10ac21d5dd06f99634daa6459bae952480cb66128905b98ed88085598543d910","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:42:41.589550Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12819/citation-record","integrity":"/paper/2507.12819/integrity","json":"/paper/2507.12819/citation-record.json","paper":"/paper/2507.12819"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.710706Z","title":"Composing text and image for image retrieval-an empirical odyssey,","venue":null,"work_id":"990d186b-e4f1-4a7e-92f2-064367294ab8","year":2019},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.296044Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:4639e95547ee89e2be74f7329a0482ff3138e1543be7e27dc7c90e0aed2c70a0","observation_id":"81f8f49a-04f6-4809-9cb8-970f61663e0c","resolution":{"observed_at":"2026-08-06T16:42:42.720576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.675463Z","title":"Empowering things with intelligence: a survey of the progress, challenges, and opportunities in artificial intelligence of things,","venue":null,"work_id":"ca656c24-eb2d-4b4f-868a-a7d58f7a3b1b","year":2020},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.385770Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:ecb118e870ba4cb9e01f1faf11cf767671ef76f960c2578a9c3082d7e472158e","observation_id":"4832dcfc-95ea-495b-855c-17d9f453621b","resolution":{"observed_at":"2026-08-06T16:42:42.685272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.641268Z","title":"Comprehensive linguistic-visual composition network for image retrieval,","venue":null,"work_id":"1f1b669f-a81b-4576-89e8-89755f888e53","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.534395Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:3d6d214fe02a5736d8305cd8ef26f42437fdcbf277a5c1b5f7b01ef29ff255b2","observation_id":"30e1723e-ef9d-4d0c-bc1c-dd1b2926997f","resolution":{"observed_at":"2026-08-06T16:42:42.650430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.619913Z","title":"Pic2Word: mapping pictures to words for zero-shot composed image retrieval,","venue":null,"work_id":"f727c6eb-dc00-46a5-80b1-8844036e0f35","year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.685912Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:d8f3cd0ac3415daf63296169a62c3ba4868e251f6fcf94b1146d21213c5a763e","observation_id":"b2ba50e7-45c0-4617-8c03-34eb87fd83f7","resolution":{"observed_at":"2026-08-06T16:42:42.626490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.595608Z","title":"Zero-shot composed image retrieval with textual inversion,","venue":null,"work_id":"7c40b5c6-6a2d-4501-8601-8ff64f63ade7","year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.858262Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:7db86822d09bd0d1655df72d74f9ce768e05ab36f5193f7474de8015f2bb4cdb","observation_id":"b6e24ca7-368d-4b57-92ea-9b3a1b36a79b","resolution":{"observed_at":"2026-08-06T16:42:42.604204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.564190Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"19fd10fb-af67-421a-b07f-75b3d407d8fc","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.038366Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:d8a24ff45021c6e4ef7f85729f056c83284d56361697c5e7a106804a15480ff3","observation_id":"3b84fd4e-3807-48a2-8b34-830cf3601919","resolution":{"observed_at":"2026-08-06T16:42:42.573699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09291","last_updated":"2024-02-26T18:59:49Z","snapshot_observed_at":"2026-08-08T20:12:12.510339Z","submitted_at":"2023-10-13T17:59:38Z","title":"Vision-by-Language for Training-Free Compositional Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09291","snapshot_observed_at":"2026-08-06T16:42:40.156102Z","title":"Vision-by- language for training-free compositional image retrieval,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.156102Z"},"links":{"cited_paper":"/paper/2310.09291","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:7980f87c8e15af84ce58d3dfad7091b1e37898570e6f0c71e7bf5e96b224a946","observation_id":"b8ea230b-1b02-4063-89f3-427c1cb390ea","resolution":{"observed_at":"2026-08-06T16:42:40.156102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04918","last_updated":"2024-11-07T06:58:04Z","snapshot_observed_at":"2026-08-10T11:51:30.197723Z","submitted_at":"2024-09-07T21:52:58Z","title":"Training-free Zero-shot Composed Image Retrieval via Weighted Modality Fusion and Similarity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04918","snapshot_observed_at":"2026-08-06T16:42:40.294719Z","title":"Training-free zero-shot com- posed image retrieval via weighted modality fusion and similarity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.294719Z"},"links":{"cited_paper":"/paper/2409.04918","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:f42f6810c7fb0003ffd28405ef0a5f0f961b8b98fb366af2f36d9b6f72b1aabc","observation_id":"f2677aa7-1298-4c39-b0e3-a1514ec44397","resolution":{"observed_at":"2026-08-06T16:42:40.294719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16752","last_updated":"2024-12-02T04:12:35Z","snapshot_observed_at":"2026-08-09T01:09:02.432481Z","submitted_at":"2024-11-24T05:27:21Z","title":"Imagine and Seek: Improving Composed Image Retrieval with an Imagined Proxy","version":2},"cited_work":{"arxiv_id":"2411.16752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16752","snapshot_observed_at":"2026-08-06T16:42:41.834214Z","title":"Imagine and Seek: Improving Composed Image Retrieval with an Imagined Proxy","venue":"cs.CV","work_id":"838c0f33-a868-464d-9047-9a06c4295b64","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.451287Z"},"links":{"cited_paper":"/paper/2411.16752","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:89892d9734c8bfedcaaf5f4dd94f567c76dec1baba7c0933dd0283228e6c27f7","observation_id":"b6876391-5553-4c3c-8555-dc856e0fe008","resolution":{"observed_at":"2026-08-06T16:42:41.886936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.524872Z","title":"MLLM-I2W: Harnessing multimodal large language model for zero-shot composed image retrieval,","venue":null,"work_id":"f79a0409-48db-4837-8f79-1d8d096a0953","year":2025},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.523118Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:7d1605f4dbfdb42bc19df01d05224d9082c60a05f292ed9a8f408c7dea8f5b8a","observation_id":"75600d3d-57e3-46dc-a89d-768bd572b139","resolution":{"observed_at":"2026-08-06T16:42:42.537891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.488502Z","title":"LDRE: LLM- based divergent reasoning and ensemble for zero-shot composed image retrieval,","venue":null,"work_id":"4f424531-ed6f-4607-9276-c3dd6fb05f0f","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.589774Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:044bb991865efe6f617b10f662813bee2bea50dadb1212f7b7aa475228bad2a4","observation_id":"dde1f7b1-60ee-48c6-9e1b-1438bb608df1","resolution":{"observed_at":"2026-08-06T16:42:42.507434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20826","last_updated":"2025-02-28T08:12:23Z","snapshot_observed_at":"2026-08-09T19:44:51.993870Z","submitted_at":"2025-02-28T08:12:23Z","title":"CoTMR: Chain-of-Thought Multi-Scale Reasoning for Training-Free Zero-Shot Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20826","snapshot_observed_at":"2026-08-06T16:42:40.679643Z","title":"CoTMR: chain-of-thought multi-scale reasoning for training-free zero-shot composed image retrieval,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.679643Z"},"links":{"cited_paper":"/paper/2502.20826","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:70d27a9753d5a5690e41c1cfc0172fb21a5164cd543fe7ea2741e1312a7fc202","observation_id":"a50fa821-9c3a-4479-a908-28068670d6ca","resolution":{"observed_at":"2026-08-06T16:42:40.679643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11077","last_updated":"2024-12-20T03:42:24Z","snapshot_observed_at":"2026-08-09T01:08:10.816469Z","submitted_at":"2024-12-15T06:22:20Z","title":"Reason-before-Retrieve: One-Stage Reflective Chain-of-Thoughts for Training-Free Zero-Shot Composed Image Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11077","snapshot_observed_at":"2026-08-06T16:42:40.759011Z","title":"Reason-before-retrieve: One-stage reflective chain-of- thoughts for training-free zero-shot composed image retrieval,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.759011Z"},"links":{"cited_paper":"/paper/2412.11077","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:e22158d89effd6e50dd17dfbdba92d5a876b3271a039bd7e93eca3edfc54c4a1","observation_id":"ccd282ff-b2e9-4ffa-af29-1d0d3ab50885","resolution":{"observed_at":"2026-08-06T16:42:40.759011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.433923Z","title":"FashionIQ: A new dataset towards retrieving images by natural language feedback,","venue":null,"work_id":"9daa8bd8-21a2-4bfe-9cfa-dba7296bde3a","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.840712Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:44c60216ef84e4e321a329723f02a944ff2ca37e3ad374bf8d6bd48ca27083c1","observation_id":"19120313-263d-4f96-9a8d-f985e431bf38","resolution":{"observed_at":"2026-08-06T16:42:42.453556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.393386Z","title":"Image retrieval on real-life images with pre-trained vision-and-language models,","venue":null,"work_id":"e4a5605b-912b-4879-b224-b71e3e0e0d10","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.924751Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:4de759b541bf56ed249f85e778a6a728eb760dc21d42a5da914110d1f1f693fc","observation_id":"46acbf82-91e7-4f01-a94c-942f8124413c","resolution":{"observed_at":"2026-08-06T16:42:42.402494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.355210Z","title":"CompoDiff: Versatile composed image retrieval with latent diffusion,","venue":null,"work_id":"c5d8a569-cc9c-4091-8811-b3f22ced4a38","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.011415Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:f99e039ba42d58c553f9c23b2f4adaa0ae507777cd0dac7f1ea0bd4685e29fd1","observation_id":"af994da3-3793-42f0-967c-79767955948b","resolution":{"observed_at":"2026-08-06T16:42:42.366372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.334461Z","title":"Language-only training of zero-shot composed image retrieval,","venue":null,"work_id":"4438ea0c-277c-44bc-bff4-d0cbb69fef34","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.069431Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:8dacbdf5694344115ba84a5025dfb06ebe81221d9f8aa5f882d4664203bcd6ff","observation_id":"f0876b80-814f-4d2e-ae37-b930f349dd71","resolution":{"observed_at":"2026-08-06T16:42:42.340048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.308332Z","title":"Uncertainty-aware mesh decoder for high fidelity 3d face reconstruction,","venue":null,"work_id":"837475aa-3da9-452e-aa90-00157ff68b1a","year":2020},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.144511Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:d873afa1cd45aa6f521b5d9f26e8ecd605995c696f0f3ffc3cb1fb91ec6854cb","observation_id":"2426016c-dbeb-450a-8f37-92e0f5efe328","resolution":{"observed_at":"2026-08-06T16:42:42.316113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.274743Z","title":"Automatic video parsing using shot boundary detection and camera operation analysis,","venue":null,"work_id":"41420ef0-27e7-49f4-9d81-12da092b6cd6","year":2001},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.216974Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:aecf058fcdaee8ac9fd045a91b3ff6ed809d691242d3a7ffcac036f3c72b935a","observation_id":"63c499ca-cd52-412f-ba88-864883870e97","resolution":{"observed_at":"2026-08-06T16:42:42.287161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:41.306674Z","title":"Multilayer cluster neural network for totally unconstrained handwritten numeral recognition,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.306674Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:e2aeac8426be2964c9f4c7759af2879aefef3f15a5f906eb592f3c8e4731ea06","observation_id":"6c4e1d60-798d-4f73-8bcc-c02772985bca","resolution":{"observed_at":"2026-08-06T16:42:41.306674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.210874Z","title":"Information captur- ing camera and developmental issues,","venue":null,"work_id":"5ae7bf66-35e1-4816-bfb6-82191654133a","year":1999},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.405813Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:456065f0d1d76d0b8b992217c5cc4faa05d0ac81ac991c4cc42f5315f13a8754","observation_id":"1de288a4-7267-4e57-b0cf-593acb385301","resolution":{"observed_at":"2026-08-06T16:42:42.224281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T16:42:41.513713Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.513713Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:a4bdec476f8da4975da5a82fabf9be66c6884949112a502e0f55ce98a3fec81d","observation_id":"cef5f7c5-0d66-4539-abc6-1442534e1663","resolution":{"observed_at":"2026-08-06T16:42:41.513713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.096390Z","title":"Multiresolution recog- nition of unconstrained handwritten numerals with wavelet transform and multilayer cluster neural network,","venue":null,"work_id":"785bc176-9240-460a-9b6c-4f83e6ef5572","year":1953},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.589550Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:146f7787df5615b74593235e40124f6c37d3598c795edd7e6a0171a3072532ca","observation_id":"ee92c5c1-ac7b-4ecc-945b-7999fe75fe63","resolution":{"observed_at":"2026-08-06T16:42:42.157972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T01:08:26.650005Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2507.12819."}