{"as_of":"2026-08-11T21:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd74406702694698b81e31c8b888db56bc95daa1f715c5ba96fac27527d1f85a","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T21:11:29.126300Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.01353/citation-record","integrity":"/paper/2607.01353/integrity","json":"/paper/2607.01353/citation-record.json","paper":"/paper/2607.01353"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.623502Z","title":"Salient-to-broad transition for video person re-identification,","venue":null,"work_id":"3fe93823-7139-4cdd-a025-cd526a9cb36a","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:32ccae4a8cb7d8d33ba229fe326b8282a15af7e1774c95da1e54b9c4d48d2fb8","observation_id":"3700c4a5-2661-4ae7-a6c9-fbf6c2c65412","resolution":{"observed_at":"2026-07-05T01:20:37.624733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.621527Z","title":"Dense interaction learning for video-based person re-identification,","venue":null,"work_id":"8f2785f5-068f-4895-bd52-309c0289d311","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:cadaba69b8507e481f14e7db999b6785c079427980006cba58464a41e91e2ecb","observation_id":"d2b055e1-af09-490a-b52e-d3e2f9e8ce30","resolution":{"observed_at":"2026-07-05T01:20:37.622832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.647946Z","title":"Bicnet-tks: Learning effi- cient spatial-temporal representation for video person re-identification,","venue":null,"work_id":"20d72418-a146-4efb-a6e0-b9928e4facaf","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:8cec8c3a838056184f1ef4c8827410b7a20479853c77e428ce5d8a26c13d8d4c","observation_id":"5149cef6-103f-455c-81a8-6e3f6c845410","resolution":{"observed_at":"2026-07-05T01:20:37.649212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.692342Z","title":"Spatial-temporal graph convolutional network for video-based person re-identification,","venue":null,"work_id":"8d3c46b3-98a8-45f5-bcaf-0f0400525a02","year":2020},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:72af6d1b749824f96d42e7d10685f1a0d16cde1bd31432dde67ce872da01c1c4","observation_id":"76491ea0-4c7d-40ee-9cab-87fa6100833e","resolution":{"observed_at":"2026-07-05T01:20:37.693586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.671153Z","title":"Pyramid spatial- temporal aggregation for video-based person re-identification,","venue":null,"work_id":"7f1800a6-84d3-4e0d-bfc6-dfac52847d76","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:7e72efba006d2ac231fb03fad0a9556502cc105e32f30783ca4fe85142099dd4","observation_id":"c8736e08-26c6-4514-806d-d879e3770822","resolution":{"observed_at":"2026-07-05T01:20:37.672321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.661134Z","title":"Watching you: Global-guided re- ciprocal learning for video-based person re-identification,","venue":null,"work_id":"5d66a2e0-2749-4f8c-bb54-c6eacac01070","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:a98697d42a74a386772ab89bc336845d1f509e70d69830cdbac5058b0cbed6a8","observation_id":"549313d5-b81b-4570-93df-c751858e44c6","resolution":{"observed_at":"2026-07-05T01:20:37.662720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.640402Z","title":"Spatio-temporal representation factorization for video-based person re- identification,","venue":null,"work_id":"07ad4bd4-b1e4-4209-b22d-1ca818b09096","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:0d99319ac209d71a6247392ff7515f8e8ca4e6bc63f3c7c6d1122bc2315027c9","observation_id":"2fdcf075-d086-4560-bf7b-37bc1f84cbed","resolution":{"observed_at":"2026-07-05T01:20:37.641783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.669105Z","title":"Mars: A video benchmark forlarge-scale person re-identification,","venue":null,"work_id":"08b5c5b4-bfda-4529-b364-431c71452fe1","year":2016},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:2d48f6b11a17c304b6751da940aa493944fd69debd6e84358560d32f48c9075a","observation_id":"1393c351-c021-4bf7-afcb-942026894525","resolution":{"observed_at":"2026-07-05T01:20:37.670383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.667246Z","title":"Multi-granularity reference-aided atten- tive feature aggregation for video-based person re-identification,","venue":null,"work_id":"d781566c-9b99-410b-acd7-d69ae588632c","year":2020},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:7a08b0c04881fb36c8216e8d2a2b5e1e759ca86c6f10456e317b0bd8999762df","observation_id":"9a82027d-0be1-4031-b0af-b0958400751b","resolution":{"observed_at":"2026-07-05T01:20:37.668527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.659148Z","title":"Pass: Part-aware self- supervised pre-training for person re-identification,","venue":null,"work_id":"1090efde-5117-4c70-a215-c7f13dbb1213","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:55bb2875c0f88044cdaadf376b9c84ffc22b49d3ad982b8de9b7c2a373e7d922","observation_id":"2d5648d6-2542-4f29-8137-dc0688133032","resolution":{"observed_at":"2026-07-05T01:20:37.660407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00921","last_updated":"2024-06-25T04:08:21Z","snapshot_observed_at":"2026-08-10T01:22:40.303610Z","submitted_at":"2021-04-02T08:00:25Z","title":"AAformer: Auto-Aligned Transformer for Person Re-Identification","version":3},"cited_work":{"arxiv_id":"2104.00921","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.00921","snapshot_observed_at":"2026-07-03T21:18:58.262350Z","title":"Aaformer: Auto-aligned transformer for person re-identification,","venue":null,"work_id":"c9bfb808-6ce7-4b1d-a650-4f89e3b5d7f8","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"cited_paper":"/paper/2104.00921","citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:a29289911849105e195112ce1137d57072a1f92d997fc2a80c0931a23a8f7928","observation_id":"fd5d2735-d4f7-43d3-8d70-1046dd973c96","resolution":{"observed_at":"2026-07-03T21:18:58.263944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.653496Z","title":"Identity-guided human semantic parsing for person re-identification,","venue":null,"work_id":"7bdacc9e-9afc-42f9-9f8f-ebb5b83692f5","year":2020},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:2b9f98f8195c67bf6ae75936d2d2591c3d56450d883f0c49d1c771500c90a79a","observation_id":"0942b198-95d8-4a20-8e69-bda28b1a5ee8","resolution":{"observed_at":"2026-07-05T01:20:37.654728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.627437Z","title":"Survey on deep learning with class im- balance,","venue":null,"work_id":"1912ecf7-e6cd-4390-907e-fd0c2997ecb7","year":2019},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:aae4540c29f338ddddd5d17788e09eb31ac877dfced7428f83c4b065bb6bbda8","observation_id":"0b54d3b4-b8ce-4d2a-b3cb-8413b92b1ef3","resolution":{"observed_at":"2026-07-05T01:20:37.628628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.655291Z","title":"Dynamic spatio-temporal specialization learning for fine-grained action recognition,","venue":null,"work_id":"eefbf3ea-098f-4f32-ac41-11ffd5d3e9b0","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:fd1f318ca0b52dcc3b0602fc05726328425901b56bdd2f8f021c2c3fac50c7f8","observation_id":"a96a606f-69a5-42fc-aea5-ad6bff238617","resolution":{"observed_at":"2026-07-05T01:20:37.656590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.636549Z","title":"Era: Expert retrieval and assembly for early action prediction,","venue":null,"work_id":"e177de8b-0e5f-40ff-9a62-f104c9ba99b6","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:055c7d65f92a8d5f7e18f688aee0e711a286b96fdfc7c2cac86dead8a12da094","observation_id":"72725b87-4ad0-4900-8152-c9965d801761","resolution":{"observed_at":"2026-07-05T01:20:37.637835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.638438Z","title":"Visualizing and understanding convolutional net- works,","venue":null,"work_id":"b605dc65-52d4-4bbe-bd02-8bfcb6b347af","year":2014},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:5e31ff1e793c6fce7e3b94c6259a4cae8a11b19e2312e9be1c9c1e95d410dfbb","observation_id":"da5c5e31-82df-42c2-92a1-e8b470935832","resolution":{"observed_at":"2026-07-05T01:20:37.639710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.665345Z","title":"Dynamic mlp for fine-grained image classification by leveraging geographical and temporal information,","venue":null,"work_id":"eb8a9217-f27c-4b90-b458-e60d6bf6a149","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:20467daaa16a853b166dc91e7029847f52919bfe4e881888bb5bff79c266f23f","observation_id":"3d92a217-9cac-4ebf-b8ca-3c2c7522e5f1","resolution":{"observed_at":"2026-07-05T01:20:37.666653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.631035Z","title":"Fine-grained object classification via self-supervised pose alignment,","venue":null,"work_id":"274fdce9-0813-46fb-a3b4-090961a1a22f","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:9d23760943798d867efb21b610e2c6ca036ad7ac639d4f445815730583cbdc03","observation_id":"9a4fc190-2757-494e-8431-3d13908ed9b8","resolution":{"observed_at":"2026-07-05T01:20:37.632390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.625563Z","title":"Grafit: Learn- ing fine-grained image representations with coarse labels,","venue":null,"work_id":"eb8a3a02-9135-43db-9c89-42bc35ad5ea6","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:29cd872e65dd473395a7318f12618de4ce39b817e3f4f1ed2db252a992872031","observation_id":"58265eaf-d722-4589-b7f4-f6daa87bde7e","resolution":{"observed_at":"2026-07-05T01:20:37.626825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.642379Z","title":"Multi-modal domain adaptation for fine-grained action recognition,","venue":null,"work_id":"d45e175a-d4e1-4add-afcd-24e1ff052386","year":2020},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:aa28c34a7950c07e03c8b2b03162eef12e42b77bcdd1aa51896489ccbbfb0ea5","observation_id":"666dffaf-9071-4173-bc9b-7becd3306e88","resolution":{"observed_at":"2026-07-05T01:20:37.643640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.663588Z","title":"Transreid: Transformer- based object re-identification,","venue":null,"work_id":"00e0eb02-87dd-4683-9f4e-7058a9394f6d","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:07dda8a434c599478e0a93dbe71276ddb8140bcf6713404c87e021ee13e3f195","observation_id":"f6a02cb7-0df9-475a-8307-c6fe3cbd7368","resolution":{"observed_at":"2026-07-05T01:20:37.664761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.651716Z","title":"Temporal complementary learn- ing for video person re-identification,","venue":null,"work_id":"28f0f1df-e6e6-4d9e-89ca-16be39cb6436","year":2020},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:afe82958b4367d561361713c8bf190ec0a30b50568031d77eda217412971b310","observation_id":"7cf0be82-1498-4e8a-8aff-ac0795619dcc","resolution":{"observed_at":"2026-07-05T01:20:37.652915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.619253Z","title":"Fine-grained shape-appearance mutual learning for cloth-changing person re-identification,","venue":null,"work_id":"1f4416b4-18a1-4a43-b84b-a6804c3a6434","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:5312d80d5fa475053511a0f1b24627efdefe646c31bc6208c7595bac63e3bddd","observation_id":"51e49c5a-6f56-4ef1-9111-85036f76f533","resolution":{"observed_at":"2026-07-05T01:20:37.620775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.644219Z","title":"Spatial-temporal correlation and topology learning for person re-identification in videos,","venue":null,"work_id":"6a1b5a18-7890-42de-bfff-3070e7e73c07","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:0b406ba6602a2809332db5ee78196f7be49f3ac29bb7683413594ec64a172d3f","observation_id":"67e6222b-b6d2-4497-a616-95c54286393f","resolution":{"observed_at":"2026-07-05T01:20:37.645528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.690565Z","title":"Video-based person re-identification with spatial and temporal memory networks,","venue":null,"work_id":"860b5571-3d69-4054-b8da-c4b9916020cf","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:c1717a312007d370b366a801690b276f0b753c69a6f9a0c40b30b83b436c828f","observation_id":"5e61eaa7-0d1e-473e-a589-372f823d79c4","resolution":{"observed_at":"2026-07-05T01:20:37.691785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.629194Z","title":"Learning multi- granular hypergraphs for video-based person re-identification,","venue":null,"work_id":"2427d4d6-04eb-4de2-a47d-0dc42a762f7a","year":2020},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:42b9864dda690c068da59706b2d8338e9172a98af4bb5425480dc396ce08b82f","observation_id":"6f7580df-1ec0-4555-b184-b466d259dd31","resolution":{"observed_at":"2026-07-05T01:20:37.630439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.688791Z","title":"Temporal complementarity- guided reinforcement learning for image-to-video person re-identification,","venue":null,"work_id":"1c8ca020-ab2f-447e-b909-3a3f10a0bd58","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:c573cae8361435677396c730f77b6d601feb5ad1932347abdf6c7002ab95f160","observation_id":"785265d0-880e-411f-9eca-b7e197721414","resolution":{"observed_at":"2026-07-05T01:20:37.690023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.694153Z","title":"Dynamic neural networks: A survey,","venue":null,"work_id":"fc03fba3-c6dd-438f-ad06-00191f9d6b6a","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:70ae5bc9987505133502bc201f838009e348ec47f7a7d3de47a72913d6039a09","observation_id":"17611456-f066-4d03-9fa0-95433708a6f6","resolution":{"observed_at":"2026-07-05T01:20:37.695339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.646115Z","title":"Skipnet: Learning dynamic routing in convolutional networks,","venue":null,"work_id":"ef854e8b-95d1-49f0-a91f-5dd273e0a3aa","year":2018},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:6a62543fa277c5de7db30c308fcfcf885da694c5b49413e8d53c1f9d0f7e6b72","observation_id":"f251a10a-c1da-4d8c-bb69-444a93d97cdf","resolution":{"observed_at":"2026-07-05T01:20:37.647371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.632968Z","title":"Dynamic routing networks,","venue":null,"work_id":"c240a597-baee-4368-9999-e3cbb210cbaf","year":2021},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:1dfb6829a8106de03a8cc0e0411d94d2882c87afabf719e8f9ffd4f58c72faef","observation_id":"3f618d7a-8c66-4cd5-bb53-e5c3f8113b00","resolution":{"observed_at":"2026-07-05T01:20:37.634192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.686962Z","title":"Matrix capsules with em routing,","venue":null,"work_id":"261010e0-df31-40a5-b896-a6c54461c8e2","year":2018},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:8b87ef0776fd3a9b268f800bb3cdcfc07eaaf43532aca67f842591a99ae0f1c4","observation_id":"12574f0f-855c-4341-9d4a-150189ae4ca7","resolution":{"observed_at":"2026-07-05T01:20:37.688159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.682824Z","title":"Categorical reparameterization with gumbel- softmax,","venue":null,"work_id":"604f3b4e-fc8c-482c-a43f-39db140e8250","year":2017},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:8f771a402f7f1e23154a994fd36e86fbcef49175d857ee223802c6117980eabb","observation_id":"1a6e3c7e-6b7d-4f4d-8de6-b654c5ada54c","resolution":{"observed_at":"2026-07-05T01:20:37.684298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.657233Z","title":"Fast decoding in sequence models using discrete latent variables,","venue":null,"work_id":"17deafaf-6531-426d-96d5-892b36170673","year":2018},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:deca52590de06bd2e5586ec693834d87bf44317676828d2594ce5f50d0d90dcf","observation_id":"f5b754fd-e849-4381-b884-fcfde05774e0","resolution":{"observed_at":"2026-07-05T01:20:37.658595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.09797","last_updated":"2018-01-29T23:36:11Z","snapshot_observed_at":"2026-08-06T12:04:37.790363Z","submitted_at":"2018-01-29T23:36:11Z","title":"Discrete Autoencoders for Sequence Models","version":1},"cited_work":{"arxiv_id":"1801.09797","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.09797","snapshot_observed_at":"2026-07-03T21:18:58.265229Z","title":"Discrete Autoencoders for Sequence Models","venue":"cs.LG","work_id":"3cd9965c-5864-4c63-95fd-2a51cd598f96","year":2018},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"cited_paper":"/paper/1801.09797","citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:8660037673b71ab0ade13e97400d08d6624979d3c84e351be14d1caa819f18c9","observation_id":"515209a4-e95c-460b-8aeb-e4730521e42b","resolution":{"observed_at":"2026-07-03T21:18:58.266719Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-04T09:19:45.912586Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":"1703.07737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-07-04T14:39:57.480607Z","title":"In Defense of the Triplet Loss for Person Re-Identification","venue":"cs.CV","work_id":"a72dd8f5-38f0-4656-b761-3af761bac9ef","year":2017},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:619c6b4ccc39fdc4cdfc98e87b40bbed2ef5b6eec04eff7bba3c7a8c3e3b8e28","observation_id":"e9461967-6b31-482e-b56c-d322908f679e","resolution":{"observed_at":"2026-07-03T21:18:58.269409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.634797Z","title":"Global-local temporal repre- sentations for video person re-identification,","venue":null,"work_id":"079cf6a5-b32d-4e2a-8237-e96c411e128a","year":2019},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:1b371f6753df2ef7899b43908303be496423db02a9402d3ba1d51cad1d739b5d","observation_id":"3abd53cd-4898-4fa5-b775-d907903fdfe6","resolution":{"observed_at":"2026-07-05T01:20:37.635973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.678988Z","title":"Deepresiduallearningforimagerecognition,","venue":null,"work_id":"4b12da43-939e-4dc4-948e-873a8824b1bf","year":2016},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:86a14e2f985f2d51119952c0f20930006a9a002b4a194a3c9c5f49590e6663b5","observation_id":"1299e4d7-c10e-4c0c-82bd-ba1a0a33eec4","resolution":{"observed_at":"2026-07-05T01:20:37.680346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.680922Z","title":"Spatially and temporally efficient non-local attention network for video-based person re-identification,","venue":null,"work_id":"54605803-8101-4e3c-977b-56e97c383a41","year":2019},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:72073896ba7b9da3b3c395f3ad25e6a1dbef63fb52ec263f8f43e278c4b1bb4c","observation_id":"bcc88595-cf89-48b7-9403-e014fcab6250","resolution":{"observed_at":"2026-07-05T01:20:37.682267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.677087Z","title":"Cavit: Contex- tual alignment vision transformer for video object re-identification,","venue":null,"work_id":"f8efba29-d2db-405a-8c83-5c8202768fc0","year":2022},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:dce54632e899079d982a7dd0c6b4e76d7d878b8f69e6c89fa4b5c0e6bfdf3854","observation_id":"7607e4d4-bc42-4f3c-8e96-7665a7f583f7","resolution":{"observed_at":"2026-07-05T01:20:37.678430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.672934Z","title":"Feature disentanglement learning with switching and aggregation for video-based person re-identification,","venue":null,"work_id":"a9e4ef01-cedc-4e95-ab49-f1ac7802db75","year":2023},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:c608b5b1485dc3cd14cd870e279ce4bb71634830d6db34ffcb40dbffaecc07e6","observation_id":"b0a88e9e-baa6-4ee4-ad05-514551987158","resolution":{"observed_at":"2026-07-05T01:20:37.674376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.675087Z","title":"Multi-granular inter-frame relation ex- ploration and global residual embedding for video-based person re-identification,","venue":null,"work_id":"37a12577-6bf4-49d5-9dd3-cd5c340e5ee5","year":2025},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:73878205d56428e063d45506d4d66ef697120d1b4df2ae34f0cc5ed3e1ae93a8","observation_id":"605b0963-5e63-42a9-aa22-ed6214ee6295","resolution":{"observed_at":"2026-07-05T01:20:37.676490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.685017Z","title":"Learningrobustevent-guided representations for person re-identification: Cao et al","venue":null,"work_id":"c7880e14-5605-412b-9a2f-36e426404e7d","year":2026},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:eaa0ae52620ae22cbb100a3de825e57b0e0cab8b2203a6dd547fa71ab8d8c6b4","observation_id":"70ef79fe-ab96-4333-bb97-216174d2b1d4","resolution":{"observed_at":"2026-07-05T01:20:37.686305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:37.649887Z","title":"Temporal knowledge propaga- tion for image-to-video person re-identification,","venue":null,"work_id":"68501461-3bc3-458e-945c-39ecb9f11dc7","year":2019},"citing_paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-03T21:11:29.126300Z"},"links":{"citing_paper":"/paper/2607.01353"},"observation_digest":"sha256:c84f064d69a8fcffdf6f43fced3c2ee6e0c7305286701b802743fe074f2140b4","observation_id":"5adb4474-e588-412f-811e-b6e5e6ef30fb","resolution":{"observed_at":"2026-07-05T01:20:37.651122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.01353","last_updated":"2026-07-01T18:11:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T15:27:19.869216Z","submitted_at":"2026-07-01T18:11:05Z","title":"Spatial-Temporal Expert Learning for Video-based Person Re-identification"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":3,"verified_fuzzy":40},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2607.01353."}