{"as_of":"2026-08-14T13:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:46ecbef2e9bf8200af6abee980e6e1bdadcd244f239efaf6ab20d60f8bc97d06","coverage":[{"denominator":111,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:38:07.718482Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.05037/citation-record","integrity":"/paper/2508.05037/integrity","json":"/paper/2508.05037/citation-record.json","paper":"/paper/2508.05037"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.258645Z","title":"Biased mixtures of experts: Enabling computer vision inference under data transfer limitations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.258645Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:ade56fd4d3493fe13ffdca6e66f80aa8a9d601c43ad64a302975df93798327af","observation_id":"8204abaa-6405-437e-a190-095efe6b3b1a","resolution":{"observed_at":"2026-08-05T23:38:05.258645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.328686Z","title":"Network of experts for large-scale image categoriza- tion","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.328686Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:578ea762794009f88c845288b884dcbdde48132b1f88436e1e3e947c1d377699","observation_id":"606366bc-3d8f-4816-8e01-4f5d770bc0a5","resolution":{"observed_at":"2026-08-05T23:38:05.328686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.369123Z","title":"Salient-to-broad transition for video person re- identification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.369123Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:9016e3b25511f29a7da12bef67c643930de077733973030419ded399e76a21de","observation_id":"fc525811-d1b0-441f-a0fc-37f02075e742","resolution":{"observed_at":"2026-08-05T23:38:05.369123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.445352Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.445352Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:45f0465da33fb6d0c1ca7f7729d22253c5da3f635e7eaede2bbaaa421eed85aa","observation_id":"a11b4141-3544-48c6-86ef-2fd29edc71cb","resolution":{"observed_at":"2026-08-05T23:38:05.445352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.530298Z","title":"Lagrange motion analysis and view em- beddings for improved gait recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.530298Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:dde0151cc053d2ffe099999dfb776c3ecc8be19ad2dba48916573cfb26db0050","observation_id":"c5dfb28d-c452-4460-812f-2ca5a84240af","resolution":{"observed_at":"2026-08-05T23:38:05.530298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.645238Z","title":"Gaitset: Regarding gait as a set for cross-view gait recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.645238Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f3022782158d06de1e69dff24f2750f44cdbdf5fe1e17803392ef3508d97e92c","observation_id":"4f8a9913-2c9d-4c33-9b7e-c2ba27a0102d","resolution":{"observed_at":"2026-08-05T23:38:05.645238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.725908Z","title":"Gaitset: Cross-view gait recognition through utilizing gait as a deep set","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.725908Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:871be3217c5a780e3a85e72e6f6f2dd84a12226dbf886720e27d4fa5e796a782","observation_id":"68322f50-2fa3-4548-9b1d-2e687ff659f2","resolution":{"observed_at":"2026-08-05T23:38:05.725908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.793214Z","title":"Learn- ing 3D shape feature for texture-insensitive person re- identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.793214Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:6c5a112af672fab0dc442c52531a4da2e0d1b35b57f08438476b956180ae374a","observation_id":"95872dda-7fce-43a2-8906-9fe2eec2ce0c","resolution":{"observed_at":"2026-08-05T23:38:05.793214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.879354Z","title":"Eve: Efficient vision-language pre-training with masked prediction and modality-aware moe","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.879354Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:cb4b18cc9c7f6f9c22739864d1efa49bf2a1769c3c0beab39fa8d9a5d896730c","observation_id":"bc208e6a-53d9-4d27-9fd7-2b9ebe83fe60","resolution":{"observed_at":"2026-08-05T23:38:05.879354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:05.981516Z","title":"Adamv-moe: Adaptive multi-task vision mixture-of-experts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:05.981516Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:64da8cfad9cea2c5fc11a61296ec1ca65e6b51bdfec5ed7c49c2d8b22771af23","observation_id":"f5bf6ffc-00af-479d-9539-3cf5ed3076eb","resolution":{"observed_at":"2026-08-05T23:38:05.981516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.082609Z","title":"Video person re-identification by temporal residual learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.082609Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:3981951504b1d72c06f13615c1ab88e28b20d8bc8a2c1619df0f9316ff195cfb","observation_id":"5f068dad-0944-46b8-b96f-6936a6e2bd58","resolution":{"observed_at":"2026-08-05T23:38:06.082609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.130916Z","title":"Generalizable person re-identification with relevance-aware mixture of experts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.130916Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:82d2309d53aed7a4d1666818639a0f4709fc7b8fec67792560b133d0b6d08da6","observation_id":"99c968c9-a01e-4bd9-8bf0-15b020d51f3b","resolution":{"observed_at":"2026-08-05T23:38:06.130916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.248054Z","title":"MEVID: Multi-view extended videos with identities for video person re-identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.248054Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:226b0946fed4ad12948c7161f895a6d60a008c5364021fd852169f76569c3a38","observation_id":"19f43ae9-54e5-44d7-9dde-09e6ffe1403c","resolution":{"observed_at":"2026-08-05T23:38:06.248054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.326162Z","title":"Metagait: Learning to learn an omni sample adaptive representation for gait recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.326162Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:9ad61636f69dcbdcc5f3597a73ce86c0d9695d22f0da54634761f95dbb373a85","observation_id":"b84d15c5-3a77-46d3-8fc0-c834e55368f4","resolution":{"observed_at":"2026-08-05T23:38:06.326162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.423625Z","title":"Gaitgci: Generative counterfactual in- tervention for gait recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.423625Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:511b17242af93dd6b0089f331baa8a3b4c1ea9adbb30bf09c9eea0e25e756293","observation_id":"6a6a85e5-f65d-4b53-96a4-d5ff2acd1bb5","resolution":{"observed_at":"2026-08-05T23:38:06.423625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.4314","last_updated":"2014-03-09T20:15:03Z","snapshot_observed_at":"2026-07-06T03:30:57.897408Z","submitted_at":"2013-12-16T11:15:10Z","title":"Learning Factored Representations in a Deep Mixture of Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.4314","snapshot_observed_at":"2026-08-05T23:38:06.473866Z","title":"Learning factored representations in a deep mixture of ex- perts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.473866Z"},"links":{"cited_paper":"/paper/1312.4314","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:b71520e7eb11debeebf9e5da1ffde2ae2526fc5997d17881d9565803e1c7a947","observation_id":"912e0643-9f9a-4056-8898-383d2a2092db","resolution":{"observed_at":"2026-08-05T23:38:06.473866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.561440Z","title":"Video-based person re-identification with spatial and tem- poral memory networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.561440Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:38b15e8814a49b100ea86ccdcdd2f5b0bfef9a93d4154a9d98701e8b0da31f88","observation_id":"481e9099-e284-4c89-a0d8-e3d3f8f0a847","resolution":{"observed_at":"2026-08-05T23:38:06.561440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.648105Z","title":"Gaitpart: Temporal part-based model for gait recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.648105Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:ace1aed697fabd01a90453e5f1470c81a6e8f025fe80a336fcd3dec89e4c9f6c","observation_id":"ea26c6b3-3b28-49cc-a72b-9cdb80777936","resolution":{"observed_at":"2026-08-05T23:38:06.648105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.759749Z","title":"Opengait: Revisiting gait recognition towards better practicality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.759749Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:54eb034bf6e30337418ed5184e5a6cc05c546c6f498890d8a256225f0ed1fba4","observation_id":"0d6c0035-28d9-445a-a294-a376ae4c98c3","resolution":{"observed_at":"2026-08-05T23:38:06.759749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.802684Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.802684Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d99eda2b4d416a7b21e2a0d27dc06d0fc2dfbeaa87ba8f35d072f79bf9b08c52","observation_id":"4c1ed0ef-2f7e-41c9-adca-b107e49b717a","resolution":{"observed_at":"2026-08-05T23:38:06.802684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:06.921751Z","title":"Sta: Spatial-temporal attention for large-scale video-based person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:06.921751Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:b3de2898ac620f8a4a7a4bb8c68c235e5e4b582c937be756e66429f02d00d82f","observation_id":"7c39652c-2954-4006-90b7-8915cf1b08c3","resolution":{"observed_at":"2026-08-05T23:38:06.921751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.078247Z","title":"Mutual mean-teaching: Pseudo label refinery for unsupervised do- main adaptation on person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.078247Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:604828320be57110b8bf503654dd93d5a9124db0e088cb2dce999f6c95ede5a8","observation_id":"db7592ea-f2f7-4188-b891-7060396c27cf","resolution":{"observed_at":"2026-08-05T23:38:07.078247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.154502Z","title":"Self- paced contrastive learning with hybrid memory for domain adaptive object re-id","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.154502Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d19e397c2ba06a0fe5191cd3208e75e9c286b19c2dc0663407169529db83e952","observation_id":"c2a8c7bd-6732-497b-90d5-dc7d2feaef15","resolution":{"observed_at":"2026-08-05T23:38:07.154502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.265504Z","title":"Hard mixtures of experts for large scale weakly supervised vision","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.265504Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:50a557c42e03bc3e2bb0ca1bbcb0789c8bac80981f30ea13a854cdf56b8811e1","observation_id":"e14c6fab-828b-4d2a-9695-c5950195adcd","resolution":{"observed_at":"2026-08-05T23:38:07.265504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.380068Z","title":"Appearance-preserving 3D convolution for video-based person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.380068Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:8074245f8621896474009107985f6bee43edf9895e12fd4a60528096184bf731","observation_id":"994442fc-f22e-449d-b7d6-935e81449977","resolution":{"observed_at":"2026-08-05T23:38:07.380068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.410203Z","title":"Clothes-changing person re-identification with RGB modality only","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.410203Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d04bc741055c307695fbb8740ef0d15c79b5330a084f02be729224f087539dd5","observation_id":"3a18463e-0eec-4327-98ec-21ee945c74f1","resolution":{"observed_at":"2026-08-05T23:38:07.410203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.414072Z","title":"Motion feature aggregation for video-based person re-identification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.414072Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:19a69dc81c40a53ada2d568c383f77a878595fb7581d70c0e356bd1646231173","observation_id":"5383c35d-631c-484c-8483-6a16a891a4f2","resolution":{"observed_at":"2026-08-05T23:38:07.414072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.419093Z","title":"Dense interaction learning for video-based person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.419093Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:73bb97bc348b4609796faecbe24d48e4ff15821426a8d70cc3cd96a63e1337a8","observation_id":"4097406d-c998-4c9f-a9ef-04af14e02256","resolution":{"observed_at":"2026-08-05T23:38:07.419093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-14T08:32:52.286202Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-08-05T23:38:07.424070Z","title":"In defense of the triplet loss for person re-identification","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.424070Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f7b5d98a69ca26c5fb01d9c6708d5cf4815e74e10b7b19da4f27d498493ef2fe","observation_id":"f9e97fd7-7ef4-4b65-8dc0-cb217787d8ff","resolution":{"observed_at":"2026-08-05T23:38:07.424070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.428841Z","title":"Temporal complementary learning for video person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.428841Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:de720d4cff465f5b969a65f375be46ef323e8e70dff246c063f00332f713d2ae","observation_id":"d0f0f743-061f-4de0-9bf9-481823e7f578","resolution":{"observed_at":"2026-08-05T23:38:07.428841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.432199Z","title":"Bicnet-tks: Learning efficient spatial- temporal representation for video person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.432199Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:3597bc3b16b26147b838be04a8e19436a0c4b20bef20995c88ade48b9a7bc8a2","observation_id":"307a7d14-0f6e-48d6-b605-0fc3c1f387f5","resolution":{"observed_at":"2026-08-05T23:38:07.432199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.436111Z","title":"Gait lateral network: Learning discriminative and compact representations for gait recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.436111Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:0d1b505521874aeae5bab3921585720713098554fefcd1648b037ea1d52d019f","observation_id":"ce85e3c4-be56-4e1b-bb85-49e0b3e61f0b","resolution":{"observed_at":"2026-08-05T23:38:07.436111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.439662Z","title":"Celebrities-ReID: A benchmark for clothes variation in long-term person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.439662Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f0f5cc68f5240d57b794138971a1a53db25b61c28509c723e1411a9521b2b5ff","observation_id":"d301e7c5-7219-4d78-967d-74b872380e4a","resolution":{"observed_at":"2026-08-05T23:38:07.439662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.442908Z","title":"Beyond scalar neuron: Adopting vector-neuron capsules for long-term person re- identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.442908Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:0a56c41b51c7d2798e7ac30fc41535c043743c07f42ebd0c4dc9e364cbec2127","observation_id":"c753b079-7a34-4ba3-a3bf-573516699e5d","resolution":{"observed_at":"2026-08-05T23:38:07.442908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.446714Z","title":"Clothing status awareness for long-term person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.446714Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:53d74b49281bc2be7f57e7d266827060be76179454c3e7b6d3e6b5979e51d1a5","observation_id":"4a0fa5d4-71d2-40ab-b9a4-d9268f24aad6","resolution":{"observed_at":"2026-08-05T23:38:07.446714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.450576Z","title":"3d local con- volutional neural networks for gait recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.450576Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:20293aea6bcd882ccc8f2c0d2d9791b1f6c3352df9c17f4c48eea4b37ead66be","observation_id":"3b571530-935f-48e5-b8d7-4ee54b4e08bb","resolution":{"observed_at":"2026-08-05T23:38:07.450576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.454550Z","title":"Adaptive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.454550Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:5ff6ecb71488959dedca59831c136b461c7b62083bfb804431d1a3526dcfa9ed","observation_id":"1caaa997-06c1-4207-8202-fd7d61a2c62b","resolution":{"observed_at":"2026-08-05T23:38:07.454550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.458077Z","title":"Prox- yfusion: Face feature aggregation through sparse experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.458077Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:5d0d00a81503324db5005f8f6e970b28b681ea332362e3aaeed2b969891420ae","observation_id":"8245fa80-0f83-478e-8e94-323232e4de7e","resolution":{"observed_at":"2026-08-05T23:38:07.458077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T23:38:07.462229Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.462229Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:79b7d40f5da02a52afa779b300ef2a8b52c3545a8f5b5efc3b2631a8da92ab64","observation_id":"cb1e78a4-dc9d-4597-acfe-53943f6b1652","resolution":{"observed_at":"2026-08-05T23:38:07.462229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.466793Z","title":"Cloth-changing person re- identification from a single image with gait prediction and regularization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.466793Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:4d7e4f5c579c5f3d4bb5f1410faffb48cec5e20d83d512bcb067900b78042248","observation_id":"6f4db0be-d31c-467e-969d-4cddaa7a3fd6","resolution":{"observed_at":"2026-08-05T23:38:07.466793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.470520Z","title":"Hierarchical mix- tures of experts and the em algorithm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.470520Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:298382f36487d286baa4c8370cb55a0286ef1f3bbc12d20ea81b9227d5e91e4d","observation_id":"35158efa-e802-463d-a767-60fa9c2ef4ce","resolution":{"observed_at":"2026-08-05T23:38:07.470520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.474660Z","title":"Feature disentanglement learning with switching and aggregation for video-based person re-identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.474660Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:34bb5be9b6f09adff95242e9a45ae959e43649a80ef2c9a0f825ef3f166ca2e5","observation_id":"e20c2cdf-c3a5-4527-8369-738efb9e07dd","resolution":{"observed_at":"2026-08-05T23:38:07.474660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.478112Z","title":"Keypoint relative position encoding for face recog- nition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.478112Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f14849ab674c0d84217f63cc772446c97d7e3f2cf9009aa7600c39d100185f00","observation_id":"3ab06d59-59c1-49f0-a2e8-3d1e9140c58b","resolution":{"observed_at":"2026-08-05T23:38:07.478112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.481993Z","title":"Sapiensid: Foundation for human recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.481993Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e64895b4328904f3c95b98edfb40e012a6e2071864ee9c1a7f7fad9aea460956","observation_id":"ef16fd3e-2ec0-4003-b0a9-4b81bae61b26","resolution":{"observed_at":"2026-08-05T23:38:07.481993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.485535Z","title":"Sparse upcy- cling: Training mixture-of-experts from dense checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.485535Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:32ce37221befccd0cb05dfa4b455255f16f314d44f0f0b0ca4b52cf00de311eb","observation_id":"bcd5376f-c7b4-4b9f-a81c-1b22b093b80f","resolution":{"observed_at":"2026-08-05T23:38:07.485535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.489458Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.489458Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:73b9f498c3bccc4cc809d944306e829861c81538b0943754d34738619e6aa655","observation_id":"8dc8aad9-3a37-49d6-aaf5-c41487204d2e","resolution":{"observed_at":"2026-08-05T23:38:07.489458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.493138Z","title":"Global-local temporal representations for video per- son re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.493138Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1527cd3a737836f63594877631a6927ecc80d5c7219682637b5156669ed76ea7","observation_id":"140a7dba-e2cb-4993-8e3c-17bcfea90dda","resolution":{"observed_at":"2026-08-05T23:38:07.493138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.497488Z","title":"Multi- scale 3D convolution network for video based person re- identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.497488Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:7f0a36e6eced38ec7f335a62be9bc3a15224b8e1af8089b56d96b12230452727","observation_id":"60b5b3ae-b44e-4507-9e2b-d9ce3a0c3927","resolution":{"observed_at":"2026-08-05T23:38:07.497488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.502321Z","title":"Unsuper- vised person re-identification by deep learning tracklet as- sociation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.502321Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:6127214d510fd80a6de9212ef835b262c62449d013b3e1d031ec486067d14bfe","observation_id":"ea38b9e5-a5ae-442f-8fa9-83ef6a279754","resolution":{"observed_at":"2026-08-05T23:38:07.502321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.506363Z","title":"Unsuper- vised tracklet person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.506363Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:fa05bc81ac7f8e8ec986c927e1ab02aa5935c25e43a547e056aa8997576d582d","observation_id":"8f014907-2f20-4e5e-9784-4b30e0afe803","resolution":{"observed_at":"2026-08-05T23:38:07.506363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.509775Z","title":"Merge, then compress: Demystify efficient SMoe with hints from its routing policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.509775Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:2668d0836ebb73cf1e27a0e6970affa1e1602f1c79d7a4a4fe10bb0e5ec22cf5","observation_id":"1a9d2412-4294-4022-94a6-56af3133f163","resolution":{"observed_at":"2026-08-05T23:38:07.509775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.515143Z","title":"Learn- ing shape representations for person re-identification under clothing change","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.515143Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:c645b56cdb226b954506cb3cda831eeb44df0006deb86df32d4c6b879e395fdf","observation_id":"535b7df7-361c-47f0-97a9-0cf4d6bfb88e","resolution":{"observed_at":"2026-08-05T23:38:07.515143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.518870Z","title":"Gaitedge: Beyond plain end-to-end gait recognition for better practicality","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.518870Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:f1bdadfd2d4470d6922c901501a077b70486f1b6de6a99a5e775d0f39ac3fec6","observation_id":"a27cdb5f-a9a3-4640-b9f6-9f11912ade98","resolution":{"observed_at":"2026-08-05T23:38:07.518870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.522367Z","title":"Gaitmask: Mask- based model for gait recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.522367Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:84526e52d7f1d90aebfc5ce6f351eb443a9c38a9763ec52952982b8419210231","observation_id":"b213d030-a634-477b-a2db-3cacf33afef4","resolution":{"observed_at":"2026-08-05T23:38:07.522367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.528601Z","title":"Gait recognition via effective global-local feature representation and local temporal aggregation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.528601Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:9268f6432337b4bad402c0865a322af1c3ec01f13c07dd8657b38eea3db6c5fe","observation_id":"837039f9-d0e4-46b1-9282-067a55d99e41","resolution":{"observed_at":"2026-08-05T23:38:07.528601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.532725Z","title":"A bottom-up clustering approach to unsupervised person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.532725Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:7b8c78a600326d1fb24338d0ba0d3def10ed161ace281f409bdd9da8955af0a8","observation_id":"c4a7a218-127c-4fb9-943f-983c4036887f","resolution":{"observed_at":"2026-08-05T23:38:07.532725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.536217Z","title":"Frozen CLIP models are efficient video learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.536217Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:917caf907cee1f3c5f2705bbe0f4e6658422f434bed0c802cf4fdd715e6fb2f6","observation_id":"0598ea20-9370-46cb-aed8-bb920c8541f7","resolution":{"observed_at":"2026-08-05T23:38:07.536217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.539586Z","title":"Learning clothing and pose invariant 3D shape rep- resentation for long-term person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.539586Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d7c9c71593e3246fe7234d7008510c08dfa52df92afe6f6ee8b5cd26ef05f650","observation_id":"9ba0a31f-70a0-4810-ac74-5cd7a8e57e88","resolution":{"observed_at":"2026-08-05T23:38:07.539586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.543794Z","title":"Farsight: A physics-driven whole-body biometric system at large dis- tance and altitude","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.543794Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:0e7c92b1f5c4a341a1ff5743f61edad97537b531b2c6df2708fb092e96155d07","observation_id":"a82ba625-56e1-4fff-87c8-b4726a224921","resolution":{"observed_at":"2026-08-05T23:38:07.543794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.547605Z","title":"Distilling clip with dual guidance for learning discrimina- tive human body shape representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.547605Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:69bcf685a453ff4fd4a14dfcd32a6e25b712ae02ecee14b332fffbf1d86a3759","observation_id":"fc0d3751-f4ba-407f-8fe1-eb9c83e9ad25","resolution":{"observed_at":"2026-08-05T23:38:07.547605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04616","last_updated":"2025-05-07T17:58:25Z","snapshot_observed_at":"2026-08-10T14:38:10.612720Z","submitted_at":"2025-05-07T17:58:25Z","title":"Person Recognition at Altitude and Range: Fusion of Face, Body Shape and Gait","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04616","snapshot_observed_at":"2026-08-05T23:38:07.551370Z","title":"Person recogni- tion at altitude and range: Fusion of face, body shape and gait","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.551370Z"},"links":{"cited_paper":"/paper/2505.04616","citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:56f7bef15953a1102d0e32c8c34380c68d65a13fca112882d2231377bcc15a15","observation_id":"d008672d-9369-4d3a-b1ea-d24bcbebd0c9","resolution":{"observed_at":"2026-08-05T23:38:07.551370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.555254Z","title":"Video-based person re-identification with accumulative motion context","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.555254Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:6a1977db75ef00963b9abe82889e8ec326d7c975d8ead6a1f5b43135cf302aa8","observation_id":"070a02bc-3acc-4285-b103-c00db56b0377","resolution":{"observed_at":"2026-08-05T23:38:07.555254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.558865Z","title":"Watching you: Global-guided recip- rocal learning for video-based person re-identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.558865Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:98f10d82517276a7a268f81513e2942ad202998918bd8cddbfe404aa34f2ac23","observation_id":"967c38ae-e84f-4923-840f-1e024dd42978","resolution":{"observed_at":"2026-08-05T23:38:07.558865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.561958Z","title":"Deeply coupled convolution–transformer with spatial– temporal complementary learning for video-based person re-identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.561958Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:722d4a14396d95524973139e1e0212714e0c9696b5073bbe32c62dcb0b392e6e","observation_id":"f0ccbb80-c864-43cd-97d7-983b72da6384","resolution":{"observed_at":"2026-08-05T23:38:07.561958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.567392Z","title":"Video-based person re-identification with long short-term representation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.567392Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:9e816d8f9aecf9b4ec5ad2e74eddb3f1c5b9a9710203d950d2620e3ad1bef27d","observation_id":"dabb276d-25f1-495a-add2-6ba659adfd5f","resolution":{"observed_at":"2026-08-05T23:38:07.567392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.570696Z","title":"A video is worth three views: Trigeminal transformers for video-based per- son re-identification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.570696Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:7ec2982957d86cc4dc3cb6cf188577376824753b8835772411bae41e517c767c","observation_id":"eefc551c-c160-4371-8a1d-7cd3b3c1b30d","resolution":{"observed_at":"2026-08-05T23:38:07.570696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.573849Z","title":"Spatial and temporal mutual promotion for video-based person re-identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.573849Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:bbbe8cdc023a56bd054c938afab904fa77e259a9024101365e4959270794e9f2","observation_id":"42973522-dc60-4b1f-9bf3-cd6680eddd4e","resolution":{"observed_at":"2026-08-05T23:38:07.573849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.577730Z","title":"Recurrent convolutional network for video-based person re-identification","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.577730Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:67d96fd86df58635123256f14111fcd518cacee00b13c009d8461ea98327b169","observation_id":"2f5815e0-327d-49ca-99fc-0874099ef27f","resolution":{"observed_at":"2026-08-05T23:38:07.577730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:08.252033Z","title":"Boult, Anderson Rocha, Haidong Zhu, Zhao- heng Zheng, Ram Nevatia, Zaigham Randhawa, Sinan Sabri, and Gianfranco Doretto","venue":null,"work_id":"0899ee91-c7c2-4c36-81c0-aecaac6f60cf","year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.582848Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:cbe9753dae8e7faa5ccc4e860e862740480ecd4c6941a469a449c986c23aa71a","observation_id":"da54670c-10af-49c2-8052-5f0420015f9a","resolution":{"observed_at":"2026-08-05T23:38:08.257456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.586095Z","title":"Temporal 3D shape modeling for video-based cloth- changing person re-identification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.586095Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:a1515cfc436889997e219dfc731a4080cadd1393975d6f87ba51b0d084111019","observation_id":"162d6088-8303-4333-9ed5-09b93b1a30e0","resolution":{"observed_at":"2026-08-05T23:38:07.586095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.589725Z","title":"Wheeler, and Xi- aoming Liu","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.589725Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:1254b37905de2156230edd448d9dcbc939b076a3f08f88f5ebf0f898f1477a6d","observation_id":"69afc1fe-0e68-43c8-be76-aad55812ff81","resolution":{"observed_at":"2026-08-05T23:38:07.589725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.593312Z","title":"Video person re-id: Fantastic techniques and where to find them (student abstract)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.593312Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d5e71d46c8b905f0711f2d51fdc8e90693fff235fafcce9a3da97fddf685ecd5","observation_id":"1ffeaa27-e7e9-461b-898a-7f6a453cf12d","resolution":{"observed_at":"2026-08-05T23:38:07.593312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.598264Z","title":"Using mixture of expert models to gain insights into semantic segmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.598264Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:9734070f075b0b3a9f4668c66499345325d694a2e876dfb8255c9210c63b979e","observation_id":"c09aa087-b379-48fa-9775-a479096f6f0d","resolution":{"observed_at":"2026-08-05T23:38:07.598264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.602126Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.602126Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e8090fa2a6f811991d75d154656c769bef66795514b3e20acf9a6dc21ce53247","observation_id":"b0633d16-3662-4ff3-95ab-7621c5ad086f","resolution":{"observed_at":"2026-08-05T23:38:07.602126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.606009Z","title":"Scaling vision with sparse mix- ture of experts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.606009Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:5ae5f47e7f4016bb80498faa1ce7b3a1dfed367de0323c78228cff12a3812e63","observation_id":"6b79f6f9-a4ef-4121-8948-40f80fb9acbc","resolution":{"observed_at":"2026-08-05T23:38:07.606009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.609966Z","title":"On the exploration of joint attribute learning for person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.609966Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:74f15ab93bb263e01dc807071a00c697da36b55b25678345f7358561f2750d86","observation_id":"daa1dec8-f03d-4081-b63c-b4e80783e8ec","resolution":{"observed_at":"2026-08-05T23:38:07.609966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.613390Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.613390Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d2e965c2a692f8303571088e9bc87f0b4a63b25a206124a6565c92c335f99f4a","observation_id":"cad4bc14-8eff-49a0-afcb-375aa50226cf","resolution":{"observed_at":"2026-08-05T23:38:07.613390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.616857Z","title":"Lidargait: Benchmarking 3d gait recognition with point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.616857Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:7b4fe746a97531ce6394789c910a97a8647cff423158bbf90187227f3e44a020","observation_id":"921b2139-52c8-4aa9-9478-a2d278937ea4","resolution":{"observed_at":"2026-08-05T23:38:07.616857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.622247Z","title":"Large-scale spatio- temporal person re-identification: Algorithms and bench- mark","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.622247Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:5c5dbc4c97e8627b8e6378aaf042104bec9ec3c4be413861ceac9d33039328f9","observation_id":"72d0e4af-0c89-4a49-9085-b9b0c9dd68d3","resolution":{"observed_at":"2026-08-05T23:38:07.622247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.629250Z","title":"Open-set biometrics: Beyond good closed-set models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.629250Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:8f96388a01ea9625b91e4bed336193ab2e9c7a169ebe3f6b6f6c36fd1cf6d30f","observation_id":"5dec5b38-a968-4d89-bc20-ca5a6eac6a98","resolution":{"observed_at":"2026-08-05T23:38:07.629250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.634195Z","title":"Wheeler, and Xiaoming Liu","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.634195Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:791937bbcd3234231dad4fe9c34be37bb331a461385168350c1fdc8a4768e576","observation_id":"931e1cf6-96f1-4242-bd3a-371bcf5926c7","resolution":{"observed_at":"2026-08-05T23:38:07.634195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.638864Z","title":"When person re-identification meets changing clothes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.638864Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:2ddb8bfdede691765f79f2d9267037d096a6bda05aa04a2150ae0f3ea498b97a","observation_id":"d67ff114-83a6-4fae-9393-746ff52ef58d","resolution":{"observed_at":"2026-08-05T23:38:07.638864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.642552Z","title":"Transferable joint attribute-identity deep learning for unsu- pervised person re-identification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.642552Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:bd2d3c455a806b80d5f2f80d1ac926fef616e8a51e5decd48a1d33e79d44f419","observation_id":"42d1be09-bb19-46fb-990e-cb2f0760bdfa","resolution":{"observed_at":"2026-08-05T23:38:07.642552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.647388Z","title":"Dygait: Ex- ploiting dynamic representations for high-performance gait recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.647388Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:60248cd52a6ea609fe64a42dda824e8e6b3f299eebb695b7dc736bb9fcf5a888","observation_id":"2720d884-4f3c-42a5-bd45-e31a0b0e51f3","resolution":{"observed_at":"2026-08-05T23:38:07.647388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.653459Z","title":"Non-local neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.653459Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:20272844f7648ab58ec60d303c27c725f724e3968474fa11a0ce7a14cc4f2dc4","observation_id":"3487116c-88de-48ee-8b54-42f7c46619f2","resolution":{"observed_at":"2026-08-05T23:38:07.653459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.658703Z","title":"Deep mixture of experts via shallow embedding","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.658703Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:75aef9937b78f2d0599534a5f01ac26812753ec8dd614304229f1f431e46fd29","observation_id":"327fad78-a02c-4bd6-b653-0c56d4e725f0","resolution":{"observed_at":"2026-08-05T23:38:07.658703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.662186Z","title":"Multi-expert adversarial attack detection in person re-identification using context inconsis- tency","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.662186Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e37e3523951c74e93e0bf2f11e887b7794c67108446339d945d475a8e75f43e8","observation_id":"c55df656-84cd-44a9-864e-71badccf36d9","resolution":{"observed_at":"2026-08-05T23:38:07.662186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.666137Z","title":"Pyramid spatial-temporal aggre- gation for video-based person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.666137Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:753a27704a891a6c01098e82c3b996adf8f3f098cbfd1042221450f611ae62c1","observation_id":"2dc78fa4-c267-42f9-995f-782ea41d8752","resolution":{"observed_at":"2026-08-05T23:38:07.666137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.670052Z","title":"Decoupled feature-based mixture of experts for multi- modal object re-identification","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.670052Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:4a089a60a0e0524645a84674bdc83c97b78fcbed8644c0959e401bd11f61eea2","observation_id":"9f22c3e3-5c1b-4022-94b4-bb9683b9ff91","resolution":{"observed_at":"2026-08-05T23:38:07.670052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.674124Z","title":"Cavit: Contextual alignment vision transformer for video object re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.674124Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:dc4573b68270995c934f7faa3bc386481382d666af9c7e833c88834564792253","observation_id":"b05ce1eb-f7f1-493b-818c-e9e029654d7d","resolution":{"observed_at":"2026-08-05T23:38:07.674124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.678133Z","title":"Adaptive graph representation learn- ing for video person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.678133Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:ecff1503e0702ab385db1fb9b98681c40cace8bdd94241008008a7de5901a62f","observation_id":"f2cd0b97-a99d-4141-835e-c060ab497d14","resolution":{"observed_at":"2026-08-05T23:38:07.678133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.682127Z","title":"DeepChange: A large long-term person re-identification benchmark with clothes change","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.682127Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:bee8ebb36c2f9aff25d9f4ee29ddfcafbb92990898cedd638e821a699baf612d","observation_id":"8573aa33-d323-4ca8-bba6-af2cbf75bf87","resolution":{"observed_at":"2026-08-05T23:38:07.682127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.686222Z","title":"Condconv: Conditionally parameterized convolu- tions for efficient inference","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.686222Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:985cbf59329f1bbf5f60c013f9a065a613ecb140c8f1c74cc4aa0ef2e9be7b87","observation_id":"b7b8ba61-b0ef-41e6-84d2-17ed0d1a92ed","resolution":{"observed_at":"2026-08-05T23:38:07.686222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.690136Z","title":"Spatial-temporal graph convolutional network for video-based person re-identification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.690136Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:4e4007ac1ffc1cc0754c54dee75501727f11301275ea5e1f2a3d5b67f2a6ba3f","observation_id":"4836c2db-fe88-4a71-9b38-bbac17ae7ef3","resolution":{"observed_at":"2026-08-05T23:38:07.690136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.694752Z","title":"Person re- identification by contour sketch under moderate clothing change","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.694752Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:cda69dfbc54b61454aa6eb3ec799ac2d1851e5d529cca3aa1f2cf1a16ef99068","observation_id":"c04ae30e-ae01-4536-892f-42e2c81b36a5","resolution":{"observed_at":"2026-08-05T23:38:07.694752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.698817Z","title":"BigGait: Learning gait representation you want by large vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.698817Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:e212738974b236639bc16eea47011c4c106a7c47c6d9e0baeb1d940815b13b3a","observation_id":"3b27dca2-36c1-44ff-9c85-c75d9456a99e","resolution":{"observed_at":"2026-08-05T23:38:07.698817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.702804Z","title":"Shiftaddvit: Mixture of multiplication primitives towards efficient vision transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.702804Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:d4f2d05f1815ff9ccee175d1b5b4204ecd97f65fa6ade39e7215cc9b5afb0040","observation_id":"8f356d0f-0995-4775-b88c-534c99f0bfc2","resolution":{"observed_at":"2026-08-05T23:38:07.702804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.708515Z","title":"Top- push video-based person re-identification","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.708515Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:77d52c49d0ca2715d2d23aaa0327bb4354c932bec1dc6826d130fa009a391f67","observation_id":"8c138145-25aa-475a-b927-51cce6864964","resolution":{"observed_at":"2026-08-05T23:38:07.708515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.713957Z","title":"TF-CLIP: Learning text-free CLIP for video-based person re-identification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.713957Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:ac44abba171a1d86f901821c6754f2f1385f0eb5751401627b997c0c60674ed4","observation_id":"ee260ba8-48ae-4d56-8e31-4812b7a29b03","resolution":{"observed_at":"2026-08-05T23:38:07.713957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:38:07.718482Z","title":"Unsupervised per- son re-identification by soft multilabel learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure","version":4},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T23:38:07.718482Z"},"links":{"citing_paper":"/paper/2508.05037"},"observation_digest":"sha256:30400370a57ce62fcd447354ed03cda3ef3d4f4126ea90852116a23744db8035","observation_id":"6c51e932-0123-4f9c-a682-44aba871046a","resolution":{"observed_at":"2026-08-05T23:38:07.718482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.05037","last_updated":"2025-09-09T02:42:55Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T08:34:17.633880Z","submitted_at":"2025-08-07T05:29:21Z","title":"A Novel Image Similarity Metric for Scene Composition Structure"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":111},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 111 outbound references and 0 inbound Pith citation observations for arXiv:2508.05037."}