{"as_of":"2026-08-12T19:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a6bec6e8291d266778721429e41a2d83de4a3138c2e5b8067906d47b05d426f","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:23:52.329362Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.05790/citation-record","integrity":"/paper/2507.05790/integrity","json":"/paper/2507.05790/citation-record.json","paper":"/paper/2507.05790"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:24:00.049561Z","title":"Street tryon: Learning in-the-wild virtual try-on from unpaired person images,","venue":null,"work_id":"d4be11c6-3ff6-4431-82e5-2de112e10ec3","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:48.381447Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:758eeff07dc1e022ee199f8093db112b50b830cb53fda4b3ad35830c3a7d637a","observation_id":"51129674-b878-4aa6-96f5-a829540185da","resolution":{"observed_at":"2026-08-06T19:24:00.230750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15886","last_updated":"2025-02-16T03:41:41Z","snapshot_observed_at":"2026-08-10T19:03:45.164103Z","submitted_at":"2024-07-21T11:58:53Z","title":"CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15886","snapshot_observed_at":"2026-08-06T19:23:48.485612Z","title":"Catvton: Concatenation is all you need for virtual try-on with diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:48.485612Z"},"links":{"cited_paper":"/paper/2407.15886","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:2e3a90bfd7b642d2cac44b482bfeda226ed52e209e6540c5b08f0be97de9a407","observation_id":"ef11259b-0b26-4d53-a0e5-777fadc80dbe","resolution":{"observed_at":"2026-08-06T19:23:48.485612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:59.727610Z","title":"M&m vto: Multi-garment virtual try-on and editing,","venue":null,"work_id":"08f6f674-b381-45e0-a6aa-d9bf7ec916dd","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:48.570285Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:3154ea7a8ea4a6d4ed60f644878bd495e0a954fe72c643f43845b06c70561bf7","observation_id":"a11eb14b-d64e-4857-b056-2a0d603deaa2","resolution":{"observed_at":"2026-08-06T19:23:59.851495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00448","last_updated":"2024-11-20T09:40:14Z","snapshot_observed_at":"2026-08-09T22:43:59.631815Z","submitted_at":"2024-05-01T11:04:22Z","title":"MMTryon: Multi-Modal Multi-Reference Control for High-Quality Fashion Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00448","snapshot_observed_at":"2026-08-06T19:23:48.676413Z","title":"Mmtryon: Multi-modal multi- reference control for high-quality fashion generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:48.676413Z"},"links":{"cited_paper":"/paper/2405.00448","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:2ff03e25b80ac2b3b667dcaad5acd008cf57824ac242e36b94fd11a10eb25781","observation_id":"39107cfb-d893-4b39-8478-5f69201ab4ff","resolution":{"observed_at":"2026-08-06T19:23:48.676413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:59.399912Z","title":"Tunnel try- on: Excavating spatial-temporal tunnels for high-quality virtual try-on in videos,","venue":null,"work_id":"2921a8e5-1a27-4a08-8f9f-c6856b184283","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:48.783914Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:c0bbf79169abab6dc4da044d0aa1d7e94c065e11b9f53239d45e8df689f48cdd","observation_id":"6e094cbd-6757-4ef9-8c36-1eaa2ee4cf07","resolution":{"observed_at":"2026-08-06T19:23:59.548979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11794","last_updated":"2024-05-28T04:08:09Z","snapshot_observed_at":"2026-07-06T18:16:33.179338Z","submitted_at":"2024-05-20T05:28:22Z","title":"ViViD: Video Virtual Try-on using Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11794","snapshot_observed_at":"2026-08-06T19:23:48.911130Z","title":"Vivid: Video virtual try-on using diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:48.911130Z"},"links":{"cited_paper":"/paper/2405.11794","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:a8ffa7384636e4b1ec3bc3a0a2241ea05c6d855be03d22573bef26fd43dc39a1","observation_id":"2f8f6e8b-1b71-4aa7-8fcf-958f26c62d88","resolution":{"observed_at":"2026-08-06T19:23:48.911130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:59.115300Z","title":"Generative adversarial networks,","venue":null,"work_id":"0fbc3ced-e6d7-458e-81e5-cfd255a81c5e","year":2020},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:48.984736Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:3915dc283383891ac4c2da1fa55747c41e0afc877f97c0d1ebd9a56416451dad","observation_id":"bc9f4267-32d8-4025-a57f-12a79cce5509","resolution":{"observed_at":"2026-08-06T19:23:59.233751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:58.821043Z","title":"High-resolution image synthesis with latent diffu- sion models,","venue":null,"work_id":"ef626fed-df81-4efb-a5b0-d982146402d2","year":2022},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.064982Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:99bd974a9b68a7c8d1677a833b04f16b6ed2823af0aeae9837ab948253d5d96f","observation_id":"38afd4c8-5ec7-4055-a869-1c7d1aff4b0d","resolution":{"observed_at":"2026-08-06T19:23:58.941530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:58.502479Z","title":"Viton: An image-based virtual try-on network,","venue":null,"work_id":"5f3172ec-48ff-4b92-8ec0-bee832adc374","year":2018},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.155321Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:8d7acfb9225d62b9cea817351dd4c24a23037b7c937ab3c4da3ddc420efda471","observation_id":"0274320f-3c0b-4bd0-875b-31db015d3255","resolution":{"observed_at":"2026-08-06T19:23:58.682585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:58.256730Z","title":"Towards photo-realistic virtual try-on by adaptively generating-preserving image content,","venue":null,"work_id":"b0930d1c-5d1e-4e0c-8579-6a782c9fcbc6","year":2020},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.246440Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:f8aa65d5587f1726b35f6a06e3951763a17fa0f0021cc3b0fa739d15550d0025","observation_id":"666b7cd3-f1cc-4878-893f-efb21b2329d2","resolution":{"observed_at":"2026-08-06T19:23:58.344003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:58.012492Z","title":"High-resolution virtual try-on with misalignment and occlusion-handled conditions,","venue":null,"work_id":"01460091-8cab-46c1-afe1-e4e832d6fca3","year":2022},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.306527Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:fd5c0e2ea90853bcb2bb30d4b2a4a802b34b9a6b26ddb57c06c0c2e3cc1302c5","observation_id":"12bcd413-466f-4dbe-96bd-c31376e37f82","resolution":{"observed_at":"2026-08-06T19:23:58.100199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:57.746677Z","title":"Gp-vton: Towards general purpose virtual try-on via collaborative local-flow global-parsing learning,","venue":null,"work_id":"8731ca43-c51d-4627-bb4b-82ba1d14191b","year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.420989Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:195c215c1265407afd39b28f8f10812bbc5795b812db8bac856f597af26070ea","observation_id":"4a7c4b23-7729-4651-bb8f-3523a9fb15c1","resolution":{"observed_at":"2026-08-06T19:23:57.889594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:57.433238Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models,","venue":null,"work_id":"746f267a-4acf-402e-9f57-1c5900da190d","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.498278Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:4f3929df1079ca2e2ed7a70bccbd78cc0e55be0fe502873b5d7312817b2ff633","observation_id":"61df0b6d-2577-4a63-85d4-a21aa50fa4b6","resolution":{"observed_at":"2026-08-06T19:23:57.572541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:57.181783Z","title":"Dragondiffusion: Enabling drag-style manipulation on diffusion mod- els,","venue":null,"work_id":"fde20973-160c-45c4-9966-286c5b50c39f","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.545190Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:bf01eab326dcfc9fda20cab0f0271b7390209d9818a11cae27a4f0a483e3eecc","observation_id":"3c0544c6-8cd8-45fb-bbca-60dbf149a1f9","resolution":{"observed_at":"2026-08-06T19:23:57.313544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:56.954619Z","title":"Diffeditor: Boosting accuracy and flexibility on diffusion-based image editing,","venue":null,"work_id":"a4b1bf71-4e1a-47ac-8f1f-ccb63f454512","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.641404Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:fedbd6124a418715b0f019f0d7bb66d92d2e3e2c0c30cfc8e244f899a9b4209b","observation_id":"0f293f4d-5124-4a77-9878-a76f9d7a7e26","resolution":{"observed_at":"2026-08-06T19:23:57.049805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:56.750101Z","title":"Stableviton: Learning semantic correspondence with latent diffusion model for virtual try-on,","venue":null,"work_id":"3ca907e0-05ca-4d03-a95b-e4889e7b4c83","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.711211Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:8b2d5a7b7d489fd16d1182616654538a4e7e85a97a88ed493b6bc2faeb051144","observation_id":"12e849cc-403d-4063-8a99-79977c9da03e","resolution":{"observed_at":"2026-08-06T19:23:56.849611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01779","last_updated":"2024-03-07T06:35:35Z","snapshot_observed_at":"2026-08-10T19:02:55.763306Z","submitted_at":"2024-03-04T07:17:44Z","title":"OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01779","snapshot_observed_at":"2026-08-06T19:23:49.790787Z","title":"Ootdiffusion: Outfitting fusion based latent diffusion for controllable virtual try-on,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.790787Z"},"links":{"cited_paper":"/paper/2403.01779","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:268896117f376435e4f4faafafc563615af3cac95a80addcb6622597b3316f42","observation_id":"08c4f31f-f26e-44f7-9af8-d29c49990a01","resolution":{"observed_at":"2026-08-06T19:23:49.790787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:56.452820Z","title":"Improving diffusion models for authentic virtual try-on in the wild,","venue":null,"work_id":"8f9f4ec2-1582-4a67-8c99-1737cbbab011","year":2025},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.873069Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:3288d9ccbdd7c653a69e8469ff00e168e4f4f74399eb34041a5312e36290b5cc","observation_id":"018c5765-6556-49bf-bde7-2b79221446fa","resolution":{"observed_at":"2026-08-06T19:23:56.584751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:56.274388Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":"cd55df54-a5d1-4e09-baca-1421fd5f60fa","year":2022},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:49.976604Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:707dff26987a8fb0656e0cd60fa87e2532b6ae53f85d3aedf594dcdb607a309e","observation_id":"895f46e9-c5ab-46de-a6be-18c5a5a58c3f","resolution":{"observed_at":"2026-08-06T19:23:56.362698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:56.037930Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality,","venue":null,"work_id":"2d09c2fc-4f22-4730-b1f7-bdcf765ab242","year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.102507Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:186f67728e92a6ed6f2a954fa3198fcde2c9c0c7a0e919155da37c512fdf0d07","observation_id":"c1cd2fb6-a2a5-4130-b338-6dcce6116e99","resolution":{"observed_at":"2026-08-06T19:23:56.140515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T19:23:50.199438Z","title":"Qwen2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.199438Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:26741a3a98f532355d760d51ac099212893ad903969ca94ebb276ff19cbae282","observation_id":"094e1789-89ff-4ec6-961f-0bfabddf2f49","resolution":{"observed_at":"2026-08-06T19:23:50.199438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T19:23:50.301874Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.301874Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:c4fd5d67289319468467f61e3f5cddd9c9fdd1fa732cd064d4b8a5966486fe58","observation_id":"e7989e18-91fb-4891-b854-a74cc19552dd","resolution":{"observed_at":"2026-08-06T19:23:50.301874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:55.776559Z","title":"Editguard: Versatile image watermarking for tamper localiza- tion and copyright protection,","venue":null,"work_id":"587a33ce-667a-4af5-9154-6aafcf3cc3e4","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.387355Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:23fdfdcad7725a025f492d271c6a80bc2edc2af843ea1fe8be1b03ddd78cc300","observation_id":"18b7a45e-76c7-41f4-ae9d-4a978ce9ee83","resolution":{"observed_at":"2026-08-06T19:23:55.912129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-07-06T15:00:13.368355Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-06T19:23:50.495918Z","title":"Visual chatgpt: Talking, drawing and editing with visual foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.495918Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:82e210e7e5c1bb2a211500460a36b089368f44db98878666af72ded4f4ffb282","observation_id":"3b9f9ff2-03c3-4d93-8b9b-a687496a24a4","resolution":{"observed_at":"2026-08-06T19:23:50.495918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:55.535643Z","title":"Gpt4tools: Teaching large language model to use tools via self-instruction,","venue":null,"work_id":"1b35247f-8e0b-4840-8b53-4a21f98fe433","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.574768Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:7ed0a0bd38989d88045037c331a251b45885fe49c45e45f6139bac57eff52a16","observation_id":"aeb55dda-77b5-4b9f-aeac-5f8d8b74afec","resolution":{"observed_at":"2026-08-06T19:23:55.650529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:55.347835Z","title":"Hugginggpt: Solving ai tasks with chatgpt and its friends in hugging face,","venue":null,"work_id":"cc1723d1-e1eb-4bac-b350-8a85573b3cb0","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.683266Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:e367549bc72709c5cbf7e1353043873f0e5b078763f352fcc4298bc14d9877e2","observation_id":"cddae71d-ca8b-4d4c-a9d4-fa9ef0474967","resolution":{"observed_at":"2026-08-06T19:23:55.424685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-06T19:23:50.774696Z","title":"Gorilla: Large language model connected with massive apis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.774696Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:2334009eaf342a92d9e52d197230488f8a48a0415e5b555b41ae29555a299f56","observation_id":"668243d3-ba42-466b-9f48-eb5ca051f849","resolution":{"observed_at":"2026-08-06T19:23:50.774696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:55.108012Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":"bf84d976-e627-4dad-90da-49b5138a70c5","year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.898982Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:669edfd276b98660d2695ee2d222656e6f5f4af1b6656204de256eb66d93b28e","observation_id":"634aa424-25ac-48c7-b82f-f092d038a8ec","resolution":{"observed_at":"2026-08-06T19:23:55.231860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:54.880458Z","title":"Self-correction for human parsing,","venue":null,"work_id":"69ee98ad-6d68-4ad2-9af6-235b73ffed19","year":2020},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:50.978601Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:9ce37559b2c54785a44cde61d618473f72b3bac868c03a1fb9e7558cccdc0661","observation_id":"8cd2b24c-5911-482f-b70e-f3fb42e13bb8","resolution":{"observed_at":"2026-08-06T19:23:54.954334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:54.615122Z","title":"Segment anything,","venue":null,"work_id":"e58f9441-b8fa-4637-875b-29578ff0b06e","year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.056934Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:043c93570b0ce5f6bb1742a6f930f7829efd1bbc8d7ba75dbd76dcc0ba3dc44a","observation_id":"e4952a3a-ec46-4a1e-ad85-ca90ba7ba5cb","resolution":{"observed_at":"2026-08-06T19:23:54.746837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:54.422424Z","title":"Densepose: Dense human pose estimation in the wild,","venue":null,"work_id":"e71d72b1-e2a6-422d-9d49-1b0be403c9c0","year":2018},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.160576Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:f55b9ca168d1056ea5727c74b5c8bf625f8d2ce7578ea8eb2fd7278bd24238f0","observation_id":"119468f7-1386-42e2-a983-a9619f2c6bb0","resolution":{"observed_at":"2026-08-06T19:23:54.521993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:54.188655Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"95fb3d20-9a83-4f51-a1e8-81891bb0fece","year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.262030Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:101d344246666e33f58b2a3be9462d00436d28dc160e99b56f30b0c27a7e0cdd","observation_id":"4844d777-0c5c-4153-901b-02963f670e08","resolution":{"observed_at":"2026-08-06T19:23:54.290084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T19:23:51.343525Z","title":"Qwen2- vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.343525Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:53cdbed3d0395ad69d416b83083c58fef2b25fe3bca9355b15249c820837d402","observation_id":"b5774a9c-00d0-4b9a-a333-df8830f80f75","resolution":{"observed_at":"2026-08-06T19:23:51.343525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-06T19:23:51.431981Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.431981Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:ab77e7dc78171d19ac1130e695b7080345e58788a895029696966ee338d35298","observation_id":"de792641-d708-4f19-aa82-bf68ea930eb3","resolution":{"observed_at":"2026-08-06T19:23:51.431981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:53.976782Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware nor- malization,","venue":null,"work_id":"d776417c-94bd-4bad-9f2d-f806e112d218","year":2021},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.555093Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:603bfa1f0c4ccc8dac579e50d3ccafe7a2e708a2b22cdb111ee7a75fb32f7643","observation_id":"4e253533-0f0c-43e7-ba8b-95f1381f5769","resolution":{"observed_at":"2026-08-06T19:23:54.084554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:53.730524Z","title":"The unreasonable effectiveness of deep features as a perceptual metric,","venue":null,"work_id":"7db11a45-a1ae-426e-bf80-1fa20570cdb7","year":2018},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.650412Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:0dc1ef1b91613b1ee55e52f9ff8c8f76b414bbb9fb0d0d5757d458e0f129bb22","observation_id":"652bc273-b20d-47e4-a683-f04c9be252d4","resolution":{"observed_at":"2026-08-06T19:23:53.848233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:53.522899Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"3ee65ee0-1964-4172-b3d6-a47acdb1d715","year":2021},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.774374Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:e60b1bfbf42a26c3f2e41bd2c5b29c5bb4ae2d53ca8be7a0984e9a89ede57105","observation_id":"47d69813-c24c-4e04-8969-595073cbc90f","resolution":{"observed_at":"2026-08-06T19:23:53.613385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:53.293669Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":"66929803-c6e7-4760-8c60-5695411e7d68","year":2017},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:51.911614Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:5ab32583f930748278e2a5ca9efb4375a50a805d3f5fe1f7606f1697334990f4","observation_id":"2bb2690f-c2f8-45ad-abbf-bf16a530930d","resolution":{"observed_at":"2026-08-06T19:23:53.389102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:53.071785Z","title":"Instructpix2pix: Learning to follow image editing instructions,","venue":null,"work_id":"f973011a-50bb-4689-b3df-17471cd0802d","year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:52.019973Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:071a123d276ba2bee8e1daef03e2152ba3a6485e3a9b7cc7eb71646479d8c899","observation_id":"43ee7a69-b34f-4564-a005-ac4f7c0df1f1","resolution":{"observed_at":"2026-08-06T19:23:53.180605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:23:52.859000Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":"2659f922-4686-423a-beac-f2f701f24453","year":2023},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:52.140602Z"},"links":{"citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:2551b5d5e2a4781fbdc08414ec92a98c013bd2a9898518e1678c6e20fe3ff7c2","observation_id":"7b0b897a-04cf-4711-b3d9-d5e971c8813c","resolution":{"observed_at":"2026-08-06T19:23:52.933579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05282","last_updated":"2024-12-19T04:42:41Z","snapshot_observed_at":"2026-08-10T11:20:42.191956Z","submitted_at":"2024-07-07T06:50:22Z","title":"UltraEdit: Instruction-based Fine-Grained Image Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05282","snapshot_observed_at":"2026-08-06T19:23:52.227005Z","title":"Ultraedit: Instruction-based fine-grained image editing at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:52.227005Z"},"links":{"cited_paper":"/paper/2407.05282","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:a25acfb7f1201252e0994b168ba7e1df5d00f4cc107bdd401dd9437ce76579d0","observation_id":"f379afb0-51fe-4b9c-a34b-6b37448e482a","resolution":{"observed_at":"2026-08-06T19:23:52.227005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09703","last_updated":"2025-03-22T10:03:38Z","snapshot_observed_at":"2026-07-06T19:50:33.453131Z","submitted_at":"2024-11-14T18:59:57Z","title":"MagicQuill: An Intelligent Interactive Image Editing System","version":2},"cited_work":{"arxiv_id":"2411.09703","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.09703","snapshot_observed_at":"2026-08-06T19:23:52.490277Z","title":"MagicQuill: An Intelligent Interactive Image Editing System","venue":"cs.CV","work_id":"4f0ea15c-d290-4670-b449-245d7d78a483","year":2024},"citing_paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:23:52.329362Z"},"links":{"cited_paper":"/paper/2411.09703","citing_paper":"/paper/2507.05790"},"observation_digest":"sha256:27051440aa47d996ad7675c9719ddfb34c7f5e3d58df46884dbe23b4f39bdfa9","observation_id":"fa0be760-921e-42a2-83b0-8d3af56c1fe4","resolution":{"observed_at":"2026-08-06T19:23:52.561486Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05790","last_updated":"2025-07-08T08:51:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T14:09:04.276662Z","submitted_at":"2025-07-08T08:51:56Z","title":"TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2507.05790."}