{"as_of":"2026-08-12T22:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c4fd77c2bdfebd17315fb8f91ecfc12870c842388425b492f588280280c5fb5","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T11:42:34.222882Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.29207/citation-record","integrity":"/paper/2607.29207/integrity","json":"/paper/2607.29207/citation-record.json","paper":"/paper/2607.29207"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.808606Z","title":"Watching you: Global- guided reciprocal learning for video-based person re-identification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.808606Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:85b79472cba0cdb1992a99fc4feeafe304add93958d2c0456acad9e0c0bb160b","observation_id":"c75da4fa-bfce-42e9-b6f8-59c158032dbd","resolution":{"observed_at":"2026-08-03T11:42:33.808606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.815241Z","title":"Deeply coupled convolution– transformer with spatial–temporal complementary learning for video- based person re-identification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.815241Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:d65c0338dad6ec94bd5bb7940da46bd44599e9445092b1b2b564b4c2bf61ccb2","observation_id":"e3b72b1d-b177-4f60-8ff8-25183dd547bd","resolution":{"observed_at":"2026-08-03T11:42:33.815241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.821762Z","title":"Other tokens matter: Exploring global and local features of vision transformers for object re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.821762Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:535f660deeeb4605f642919a5506e4b706bd3d5b88706a5fe6315d51a7bafdfa","observation_id":"0e012ce8-a2e2-4789-a372-9f96accf0b14","resolution":{"observed_at":"2026-08-03T11:42:33.821762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.827559Z","title":"A video is worth three views: Trigeminal transformers for video-based person re- identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.827559Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:b84644e5f129cf1237933ecc47ea8f6f3bfe10c10b881267d5f4b6334d0d8fdc","observation_id":"124faf2b-14af-4b16-9d96-82ecdb9a790b","resolution":{"observed_at":"2026-08-03T11:42:33.827559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.835546Z","title":"Tf-clip: Learning text-free clip for video-based person re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.835546Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:8f0d2f79316defdb9ffd2835e0f4b261f7811b3d4d4eceb1d9eb21ff70921cba","observation_id":"0b306a8e-c716-4bd7-a4ce-5d1d42517126","resolution":{"observed_at":"2026-08-03T11:42:33.835546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.840478Z","title":"Context-aided semantic- aware self-alignment for video-based person re-identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.840478Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:c3a93018346deb8965f9232dedc3cd2e5f9c74ef8691d32a89a032abac4e08a9","observation_id":"900be0c6-a727-4a26-89bb-203f445c3581","resolution":{"observed_at":"2026-08-03T11:42:33.840478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.846184Z","title":"Joint self-attention and scale- aggregation for self-calibrated deraining network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.846184Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:34e6aa648650e59818ca5393b8792c588ade177cf208942fead1483eb6d1156b","observation_id":"8acd5aa6-a4a4-4270-88fd-d14d230f8ea3","resolution":{"observed_at":"2026-08-03T11:42:33.846184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.851360Z","title":"Semi-supervised image deraining using knowledge distillation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.851360Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:d53b5f97fef79ab6ee098c7afac9d72be78c7b8de6f1e7c614a1a128398aed69","observation_id":"65984a61-a87c-4ead-a05e-115a322b07b9","resolution":{"observed_at":"2026-08-03T11:42:33.851360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.856980Z","title":"Perceplie: A new path to perceptual low-light image enhancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.856980Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:f0bad3d1801b9ec8428927aefc11002b21630d697dbb21ae029325f1300b6be8","observation_id":"56207960-d2e8-4bbf-9147-4380dd4c33e7","resolution":{"observed_at":"2026-08-03T11:42:33.856980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.865046Z","title":"Correlation matching transformation transformers for uhd image restoration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.865046Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:a8531d5ae56830e3dc26cb50f031fead36c016f035fca41589924ba5157384ee","observation_id":"78708977-e483-4f0a-8106-fa134998e605","resolution":{"observed_at":"2026-08-03T11:42:33.865046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.870824Z","title":"Neural discrimination-prompted transformers for efficient uhd image restoration and enhancement: C. wang et al","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.870824Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:ae9f3e63a5c3a01dcbd218f466524c299bebba31178f59f7051a9906469e6fa4","observation_id":"ae8d83db-cbb1-43f7-b046-0707ad775f68","resolution":{"observed_at":"2026-08-03T11:42:33.870824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.876767Z","title":"Top-reid: Multi- spectral object re-identification with token permutation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.876767Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:33c1849d1297465a6614466943258ad610366822c4180dfa214d4dc405187794","observation_id":"5c8172f7-a6d4-4b4f-8e4c-8f2731dc72b9","resolution":{"observed_at":"2026-08-03T11:42:33.876767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.882062Z","title":"Inter-modality simi- larity learning for unsupervised multi-modality person re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.882062Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:cc42b74146dff9cea1ea0340877435654e63a204e93a4a72c4f2897b3e90392b","observation_id":"b785c949-2c12-421a-827e-f3821be002a3","resolution":{"observed_at":"2026-08-03T11:42:33.882062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.887415Z","title":"Representation selective coupling via token sparsification for multi- spectral object re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.887415Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:d825b09f0d8fa8067a7ce60bfe608b433979c14912fc22f3a1215ee5ecf28bb0","observation_id":"ebee555e-8364-48f2-9c66-c0f9cefa454e","resolution":{"observed_at":"2026-08-03T11:42:33.887415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.893249Z","title":"Enhanc- ing visible-infrared person re-identification with modality-and instance- aware adaptation learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.893249Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:b5867442dc7b5cbcb61a69cfd972bf2136b1e76e61c4acc602e6c7d1a6c1dcc6","observation_id":"53e86811-be96-4608-8783-bd99ed8561ec","resolution":{"observed_at":"2026-08-03T11:42:33.893249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.899752Z","title":"Harmonizing metric discrepancy for cross-modal object re-identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.899752Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:7a4166a67a480c049a1109cb4a386fa36380b94d1cd614d8de28e8957ca89fd5","observation_id":"35956ff8-cb0f-4500-a67f-d2e29de45744","resolution":{"observed_at":"2026-08-03T11:42:33.899752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.904894Z","title":"Idea: Inverted text with cooper- ative deformable aggregation for multi-modal object re-identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.904894Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:60987ed2d70e7b8268baeb0c2570ef363c8ba80521dc731f097db486bb51061a","observation_id":"53ada0df-4682-4ef2-8016-b1d07554c1b1","resolution":{"observed_at":"2026-08-03T11:42:33.904894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20001","last_updated":"2026-05-11T13:20:30Z","snapshot_observed_at":"2026-08-09T19:49:55.771236Z","submitted_at":"2025-05-26T13:52:28Z","title":"NEXT: Multi-Grained Mixture of Experts via Text-Modulation for Multi-Modal Object Re-Identification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20001","snapshot_observed_at":"2026-08-03T11:42:33.910187Z","title":"Next: Multi-grained mixture of experts via text-modulation for multi-modal object re-id,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.910187Z"},"links":{"cited_paper":"/paper/2505.20001","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:88676214cd07ed419bda0c0df0f2afed4deadb4c688b07377fb0a952125aed2a","observation_id":"539ca431-5060-41f0-8666-5dd7f5582d9a","resolution":{"observed_at":"2026-08-03T11:42:33.910187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.914949Z","title":"Magic tokens: Select diverse tokens for multi-modal object re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.914949Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:4917471dfc8be8c8c0b9480e31b253b2ae460dd7b91df1210a051eaa3f6e59ca","observation_id":"9415aa91-0cc6-4e05-a6fd-b39a2f93013a","resolution":{"observed_at":"2026-08-03T11:42:33.914949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.919639Z","title":"Deep learning for person re-identification: A survey and outlook,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.919639Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:dc39c718ccaf2b9b7faa3973fc1142d89d4c9d06da9cfe67a4e09a84b027eec0","observation_id":"32521b1c-4330-4bff-94bc-1e420fe7f29b","resolution":{"observed_at":"2026-08-03T11:42:33.919639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.927013Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.927013Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:406fe6312db973b5e1ed794a19c64e7526aed5ea62a7013f5c44ecf1466719ff","observation_id":"112371f4-8a1e-45b9-9047-cfcd9ac5a911","resolution":{"observed_at":"2026-08-03T11:42:33.927013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.933833Z","title":"Clip-reid: exploiting vision-language model for image re-identification without concrete text labels,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.933833Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:c1aae06a81a06cf6a7c64ad2ebc00860361f7ef3217a45b45fb9dfa7ab2a109f","observation_id":"a38cf87f-18cc-4178-a30b-ce5bd6e8199a","resolution":{"observed_at":"2026-08-03T11:42:33.933833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17821","last_updated":"2025-05-23T12:38:27Z","snapshot_observed_at":"2026-08-09T00:31:46.795235Z","submitted_at":"2025-05-23T12:38:27Z","title":"ICPL-ReID: Identity-Conditional Prompt Learning for Multi-Spectral Object Re-Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17821","snapshot_observed_at":"2026-08-03T11:42:33.939226Z","title":"Icpl-reid: Identity- conditional prompt learning for multi-spectral object re-identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.939226Z"},"links":{"cited_paper":"/paper/2505.17821","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:2448fbc92b3b0ed4316c49a2c5d4b68b5d2b8f035669fd422777598f56ab62c0","observation_id":"cd0c6c28-ee64-4063-9dc1-7420040aa958","resolution":{"observed_at":"2026-08-03T11:42:33.939226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.944829Z","title":"Zero-shot composed image retrieval with textual inversion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.944829Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:19aa686a7726fccd7ea71fa49b3965bfdb19b399e6121cbf14a534722c3df15c","observation_id":"4bf7e60e-ad2b-4308-8443-9e51e3f609b0","resolution":{"observed_at":"2026-08-03T11:42:33.944829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.949812Z","title":"Decoupled feature-based mixture of experts for multi-modal object re-identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.949812Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:7fe6d618c3eedddff01ac1c5f7ddbb27697f11d38dfe1bac4959fd985d86b6af","observation_id":"7271679d-8cc2-4716-a711-c4c57a5a046f","resolution":{"observed_at":"2026-08-03T11:42:33.949812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.956104Z","title":"Ugg- reid: Uncertainty-guided graph model for multi-modal object re- identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.956104Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:66cecc3afc87b9e2e8546dcea4c337fcfc979d03519a1548a1239db1630310e5","observation_id":"2ebb4285-ed73-450f-bb59-522f891a3cca","resolution":{"observed_at":"2026-08-03T11:42:33.956104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.960932Z","title":"Robust multi-modality person re-identification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.960932Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:59a0c7455a739a7fa49f88b71d3202d023a47eecee12159e0de0c623c4764b0d","observation_id":"c34a0480-6af7-44a8-843f-6978284536cb","resolution":{"observed_at":"2026-08-03T11:42:33.960932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.966202Z","title":"Interact, embed, and enlarge: Boosting modality-specific representations for multi-modal person re-identification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.966202Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:83357b73b54034df9bd0705fc2b109c548bede0defbdf28809e7ee20c3d0d2cc","observation_id":"7b041625-acb0-4f25-b20b-03f14be9ff35","resolution":{"observed_at":"2026-08-03T11:42:33.966202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.971213Z","title":"Multi-spectral vehicle re-identification: A challenge,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.971213Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:ee5de09f49efa49b4de2453502b1fd779689beec41c86424b90c6ff421794e5a","observation_id":"7af7a69a-0355-4eef-b9b0-7b6fc5387470","resolution":{"observed_at":"2026-08-03T11:42:33.971213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.976875Z","title":"Graph-based progressive fusion network for multi-modality vehicle re-identification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.976875Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:4a2dd2e965065513e51ebdbb51b1fc6baed4d85ef5cdbda93baf13d1219b8b27","observation_id":"b722d15f-2ce2-4b6d-bd5c-34a57d4c2952","resolution":{"observed_at":"2026-08-03T11:42:33.976875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.981640Z","title":"Progressively hybrid transformer for multi-modal vehicle re-identification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.981640Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:11b668cc84055a67be8e6a080e1d2b58d6fd68016108a1e422259d934ecadd45","observation_id":"d4b76a44-06e3-45da-9d24-f1188db63651","resolution":{"observed_at":"2026-08-03T11:42:33.981640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-03T11:42:33.986386Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.986386Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:f4428c19a4c9df22768a456fa9118c30a6a1eaafd7eb20bb5290a60e6d7655ff","observation_id":"d8c711f8-87d5-4012-9986-91b9740c4e26","resolution":{"observed_at":"2026-08-03T11:42:33.986386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18812","last_updated":"2023-10-28T20:30:59Z","snapshot_observed_at":"2026-08-10T03:50:16.991036Z","submitted_at":"2023-10-28T20:30:59Z","title":"UniCat: Crafting a Stronger Fusion Baseline for Multimodal Re-Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18812","snapshot_observed_at":"2026-08-03T11:42:33.991683Z","title":"Unicat: Crafting a stronger fusion baseline for multimodal re-identification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.991683Z"},"links":{"cited_paper":"/paper/2310.18812","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:c370e879e8b75ed0581aa6400646d5dc9aa5469941512719bd672c0a33d028ec","observation_id":"a72a38e4-b585-42a9-98e0-a3f488a4fcc5","resolution":{"observed_at":"2026-08-03T11:42:33.991683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:33.996602Z","title":"Heterogeneous test-time training for multi-modal person re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:33.996602Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:d5e220226c0637a7e8296b009d5527a27c2fc0bc19b706e27a22d9477a9476d2","observation_id":"f0216763-4c3f-43a7-be8b-fcfda362d1b4","resolution":{"observed_at":"2026-08-03T11:42:33.996602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.001258Z","title":"Mam- bapro: Multi-modal object re-identification with mamba aggregation and synergistic prompt,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.001258Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:4330dc72b502d577b989ad6f8975b02cb7ca897a6e25d1e5488f250e4c55cb5f","observation_id":"d3f525bf-6bc4-47bc-9bae-86640e395d33","resolution":{"observed_at":"2026-08-03T11:42:34.001258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.007812Z","title":"Mask-guided contrastive attention model for person re-identification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.007812Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:148521c97d1bae012e1455b1b901a4208182d092053de613e6dd2d2612b2058f","observation_id":"d328c8e6-7864-465d-9ab3-41c2a5c6cc3c","resolution":{"observed_at":"2026-08-03T11:42:34.007812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.013287Z","title":"A mask based deep ranking neural network for person retrieval,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.013287Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:3a2062df6493eed303e544f1ae08b3360a155df040f730860438644b1aafdbee","observation_id":"210f46dc-57d7-45da-bb7e-6268663c7bcf","resolution":{"observed_at":"2026-08-03T11:42:34.013287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.018658Z","title":"Identity-guided human semantic parsing for person re-identification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.018658Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:de1a97f6d201cc629282a4f0c6b00f77491a4fbec0d5e4e5d876d639617470bb","observation_id":"55d62f25-8ba8-4710-8f4f-ba3f88046a6d","resolution":{"observed_at":"2026-08-03T11:42:34.018658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.023405Z","title":"Profd: Prompt-guided feature disentangling for occluded person re- identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.023405Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:0da9b9b2b73bab49f3557368ad46e9fd886e0692119411497e97a37d86e78f04","observation_id":"2e63f628-7a5c-470c-b07f-a723ab643e1e","resolution":{"observed_at":"2026-08-03T11:42:34.023405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.028148Z","title":"Keypoint promptable re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.028148Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:952cc175f988c2f116e3c91ebb713d746e8a959ebbb887d45b554036ee025fa0","observation_id":"15284352-8721-4b09-a51d-e41a412e57c5","resolution":{"observed_at":"2026-08-03T11:42:34.028148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.033383Z","title":"Pose-skeleton guided cross-attention representation fusion for occluded pedestrian re- identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.033383Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:23c539aefbfc07b9d7aac113718611676c865729a5306df27cce4e448268604d","observation_id":"e51d912a-8c14-47cd-a6f7-c0f872c248a5","resolution":{"observed_at":"2026-08-03T11:42:34.033383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.040395Z","title":"Multiple information prompt learning for cloth-changing person re-identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.040395Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:e2bc5a2fe0a0bdb3064aa651e5fc6fdaa5dbd1e5f4c142d99c202d7ca550d946","observation_id":"3f118ef2-861d-40d0-8c89-515e807cf2ad","resolution":{"observed_at":"2026-08-03T11:42:34.040395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.045092Z","title":"Multi- prompts learning with cross-modal alignment for attribute-based person re-identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.045092Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:17e0c376ce255fd0b532df1424ca9f7af56d0bc66594f7a878e1a09812f96432","observation_id":"8e6caadf-817f-4bc2-ad9e-81cf2a3e00e5","resolution":{"observed_at":"2026-08-03T11:42:34.045092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.049870Z","title":"Recommendation ITU-R BT.601: Studio encoding parameters of digital television for standard 4:3 and wide-screen 16:9 aspect ratios,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.049870Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:9217d353c682e98d85b4a42cc5cb7209e1784de4437a946695ae8531322bee76","observation_id":"db4b0ef2-fc65-42f5-ba5b-203da84a0b85","resolution":{"observed_at":"2026-08-03T11:42:34.049870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-03T11:42:34.057009Z","title":"Sam 2: Segment anything in images and videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.057009Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:16833116c9acda91d1083ffb4f06afaf706f94675f14b34e0b603149f702c32c","observation_id":"fff6d375-516b-4e24-892a-37d95a4b8c35","resolution":{"observed_at":"2026-08-03T11:42:34.057009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.062430Z","title":"Fine-tuning cnn image retrieval with no human annotation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.062430Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:b14b18f721b9b66d6f28c9799149e4402d133fc653fbbdee6aac7f7fc4e0a71c","observation_id":"d14ecf89-7d04-429b-8834-3ec286660d85","resolution":{"observed_at":"2026-08-03T11:42:34.062430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.067539Z","title":"Hypergraph neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.067539Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:ba55be9f417b0e822c1c1dc5d6d8bd84f5ba1a3cc1604f6875fa688eec625181","observation_id":"84a84026-c078-4759-be80-f702d3c704b4","resolution":{"observed_at":"2026-08-03T11:42:34.067539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.073547Z","title":"Smartfreeedit: Mask-free spatial-aware image editing with complex instruction understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.073547Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:7843b0bd4312b62e909fc2a18715ee7030344774a0dac4b401ba835f63e02ce2","observation_id":"8ef00ad6-06e0-48d4-b6fe-bb3775cf3af8","resolution":{"observed_at":"2026-08-03T11:42:34.073547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.078585Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.078585Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:75a7aae813734a7284b685f2c5b6541085d11ca109cf63f6a6cde2cde5500ad4","observation_id":"3acf9fea-7b61-42dc-846c-f6351e0e3e38","resolution":{"observed_at":"2026-08-03T11:42:34.078585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-12T04:14:58.866318Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-03T11:42:34.084181Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.084181Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:8bc7a180b0c1b4482376a04472ab77201c5cf27cc886cefe19bb2c1a8121cd95","observation_id":"fcfe16c6-99c8-44c0-a312-f50c8b0fedad","resolution":{"observed_at":"2026-08-03T11:42:34.084181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.089343Z","title":"Rethinking the inception architecture for computer vision,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.089343Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:e4cfddc1ed05f645e358c6f926e1dcce072866f919e82ab76e4d929c84cad49c","observation_id":"62e66747-c470-42fa-96e0-79d10f6900bd","resolution":{"observed_at":"2026-08-03T11:42:34.089343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-04T09:19:45.912586Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-08-03T11:42:34.095327Z","title":"In defense of the triplet loss for person re-identification,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.095327Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:c49555b4d347cf4006572fa959cc6662ecb084777751a6e885168fbd3b0b7bf9","observation_id":"57638624-feb1-40ee-ad86-d349d3ad7be6","resolution":{"observed_at":"2026-08-03T11:42:34.095327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-03T11:42:34.099847Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.099847Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:68b9b970ccfd3452a1f2e8bef2b82cf0defc938d99fcc47a7a7a90fb640c154d","observation_id":"f061a71c-7bb7-47c0-b30b-c427b3d920f1","resolution":{"observed_at":"2026-08-03T11:42:34.099847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.104798Z","title":"Cross-directional consistency network with adaptive layer normalization for multi-spectral vehicle re-identification and a high-quality benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.104798Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:e593d0778808b01f17a52960457dd1f3a42b48b8c917213669a1d536ea905fd8","observation_id":"9bce012d-8693-4fa7-a2ac-ba09e3b5e225","resolution":{"observed_at":"2026-08-03T11:42:34.104798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.109318Z","title":"Omni-scale feature learning for person re-identification,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.109318Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:32568cc17296b3c75b3c0fff1278582bbfaf6336748c1f6721d3bd1e1118342f","observation_id":"36bba419-952e-4ad8-8bcb-55a9cd4ed73c","resolution":{"observed_at":"2026-08-03T11:42:34.109318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.113829Z","title":"Counterfactual attention learning for fine-grained visual categorization and re-identification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.113829Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:949ff58aacff1f5440d6ed983de70baa5d53f03dccde118a73622a128a33a980","observation_id":"13cd7926-6db7-4080-9e10-caac3d7836c7","resolution":{"observed_at":"2026-08-03T11:42:34.113829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.118245Z","title":"Beyond part models: Person retrieval with refined part pooling (and a strong convolutional baseline),","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.118245Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:a708aa62879485f72cada340ccf0ca245dd974d7495b6f359d11043c7bf090eb","observation_id":"0a8f4dd0-b1c1-41ae-b10b-2de1ea590278","resolution":{"observed_at":"2026-08-03T11:42:34.118245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15762","last_updated":"2023-05-25T06:22:01Z","snapshot_observed_at":"2026-07-06T15:33:06.904026Z","submitted_at":"2023-05-25T06:22:01Z","title":"Dynamic Enhancement Network for Partial Multi-modality Person Re-identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15762","snapshot_observed_at":"2026-08-03T11:42:34.122708Z","title":"Dynamic en- hancement network for partial multi-modality person re-identification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.122708Z"},"links":{"cited_paper":"/paper/2305.15762","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:4732fcabb5a034fa71d242c5bf4e4974485533d8a2b8580677dddbd8649c79d4","observation_id":"19b49bca-9b02-4baa-9c0e-ed44e8859707","resolution":{"observed_at":"2026-08-03T11:42:34.122708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.128321Z","title":"Lrmm: Low rank multi-scale multi-modal fusion for person re-identification based on rgb-ni-ti,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.128321Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:5e952d8d4f00c7c1d374d7e347f6c4b3b8c0785a87697afccf91de46c0571d95","observation_id":"3df2419b-4d3f-4c49-8877-d7da390dd992","resolution":{"observed_at":"2026-08-03T11:42:34.128321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.134506Z","title":"Wtsf-reid: Depth-driven window-oriented token selection and fusion for multi-modality vehicle re-identification with knowledge consistency constraint,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.134506Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:1e1796c9548a068c4935916dfcdf2f39a92a6cbfa3991efc5db0bd921539c582","observation_id":"82c365ad-a784-4ad2-8100-af85d5770bc2","resolution":{"observed_at":"2026-08-03T11:42:34.134506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.139219Z","title":"Escaping modal interactions: An efficient desanet for multi-modal object re- identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.139219Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:73b2051d9d25b490fe56aecb192dbc517d2bdcdac1fb78198023511867c6034b","observation_id":"7b31a33e-89e4-451a-b4a4-eb607bf61bc8","resolution":{"observed_at":"2026-08-03T11:42:34.139219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.144563Z","title":"Mdreid: Modality- decoupled learning for any-to-any multi-modal object re-identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.144563Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:f5fa10721a49fb71e4dceb6fdbf36ae56cb1fd17b43970c2f4aaf7a7979540d1","observation_id":"2128a70a-72c8-4714-b601-1c2cc806ee2a","resolution":{"observed_at":"2026-08-03T11:42:34.144563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.149561Z","title":"Signal: Selective interaction and global- local alignment for multi-modal object re-identification,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.149561Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:1f2a2440d252ee657442f674b625e7d60e621cca1acddb3824d14df01af5702c","observation_id":"4891555d-1c2c-4472-ba78-c3070fe1eae5","resolution":{"observed_at":"2026-08-03T11:42:34.149561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.155033Z","title":"Reliable multi-modal object re-identification via modality-aware graph reason- ing,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.155033Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:db34bff911c189a09be6956319b2d9541eb013460c3b9e188ef4a0fe8035f6b7","observation_id":"39b1903a-4fe4-4fa1-823a-07f769c0c8f7","resolution":{"observed_at":"2026-08-03T11:42:34.155033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.159335Z","title":"Random erasing data augmentation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.159335Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:559fadc27ddee8060648d26773cf8a90aa99a5cf13da7f49ad16b3779c4075a8","observation_id":"dc8440c0-45bc-4550-a54b-790786b8a371","resolution":{"observed_at":"2026-08-03T11:42:34.159335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.164616Z","title":"Transreid: Transformer-based object re-identification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.164616Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:7607d3c9f5f3e2f6526c08d790b8be76eb9d54c006b0e4b6be0f007eb6207db0","observation_id":"3c448f16-ceea-41dd-ba68-6dbacdef31d4","resolution":{"observed_at":"2026-08-03T11:42:34.164616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.170684Z","title":"Generative and attentive fusion for multi-spectral vehicle re-identification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.170684Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:73d8506c6d6279a15acf4b323e6e1d9f84a4aab6669e0f1ab6953f3d7dde6675","observation_id":"543c89a4-71e3-4c0a-9134-38cfb9603bcd","resolution":{"observed_at":"2026-08-03T11:42:34.170684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16856","last_updated":"2023-10-25T00:15:40Z","snapshot_observed_at":"2026-08-10T13:34:19.930988Z","submitted_at":"2023-10-25T00:15:40Z","title":"GraFT: Gradual Fusion Transformer for Multimodal Re-Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16856","snapshot_observed_at":"2026-08-03T11:42:34.180201Z","title":"Graft: Gradual fusion transformer for multimodal re-identification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.180201Z"},"links":{"cited_paper":"/paper/2310.16856","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:7cf4a9de21f08d45fb7b4a2e73e163b0c00608bf34dba792a5324dbe5bcc3564","observation_id":"cda0fe54-c8f1-4557-ae34-5f903ca590be","resolution":{"observed_at":"2026-08-03T11:42:34.180201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.186678Z","title":"Flare- aware cross-modal enhancement network for multi-spectral vehicle re- identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.186678Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:05ef8f294cf09f68f738e841e196f99c305b138f45f03ecd7295ffb7d1976854","observation_id":"f51073b9-42c7-47e8-83d7-af830717a595","resolution":{"observed_at":"2026-08-03T11:42:34.186678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.202635Z","title":"Stmi: Segmentation-guided token modulation with cross- modal hypergraph interaction for multi-modal object re-identification,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.202635Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:d82105e369810095daa5baaab0d22216f4e557eba9d804cc89fd3b8372d15acf","observation_id":"808cff62-23b8-4dd3-b6da-15914882a4e0","resolution":{"observed_at":"2026-08-03T11:42:34.202635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.210525Z","title":"Prompt-based modality alignment for effective multi-modal object re- identification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.210525Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:45027a8253f5bb4d8ec36805dff22a17e7fff90ebaa82cfabd478ac340d63c7f","observation_id":"c67664ac-b957-4b14-bbd6-595ef17c2234","resolution":{"observed_at":"2026-08-03T11:42:34.210525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:42:34.215636Z","title":"Visualizing data using t-sne","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.215636Z"},"links":{"citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:fbd562498ab1e895afbc7112fc8acdebe589bbffde9c71d3ee064543eb47ed7b","observation_id":"37eae2cd-d3f3-49c3-93f0-d082b50dc0c6","resolution":{"observed_at":"2026-08-03T11:42:34.215636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-03T11:42:34.222882Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T11:42:34.222882Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2607.29207"},"observation_digest":"sha256:7bb22d92e2750cd951786107eb077474d7c6aab49fe118109ecac71d2ac15f70","observation_id":"a671b860-bce6-43aa-88e4-36410fbfd452","resolution":{"observed_at":"2026-08-03T11:42:34.222882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.29207","last_updated":"2026-07-31T09:27:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T12:09:02.521476Z","submitted_at":"2026-07-31T09:27:10Z","title":"Multi-Modal Object Re-Identification with Dual Semantic Guidance and Global-Local Mutual Modulation"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":73,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 0 inbound Pith citation observations for arXiv:2607.29207."}