{"as_of":"2026-08-19T03:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7085a5e27122cbb15aa1cf9da70d1989e3ae735551a6c20cede9e42a978f6d9","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:57:55.958198Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:56:05.275013Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"cited_work":{"arxiv_id":"1908.10049","doi":"10.48550/arxiv.1908.10049","metadata_source":"pith","pith_arxiv_id":"1908.10049","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","venue":"cs.CV","work_id":"d30964dd-d2a5-45ff-94e8-1b170ced7a84","year":2019},"citing_paper":{"arxiv_id":"2505.20540","last_updated":"2025-05-28T10:53:23Z","snapshot_observed_at":"2026-08-13T18:29:08.654252Z","submitted_at":"2025-05-26T22:03:23Z","title":"Causality and \"In-the-Wild\" Video-Based Person Re-ID: A Survey","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:56:05.275013Z"},"links":{"cited_paper":"/paper/1908.10049","citing_paper":"/paper/2505.20540"},"observation_digest":"sha256:9c98141c448034de45c0e31f43123282e869c5adfb7b85f9f8243da87d67e20a","observation_id":"5a694170-8b37-4441-98ae-d7a60451b18b","resolution":{"observed_at":"2026-08-07T13:56:13.734858Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.10049/citation-record","integrity":"/paper/1908.10049/integrity","json":"/paper/1908.10049/citation-record.json","paper":"/paper/1908.10049"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1809.08556","last_updated":"2018-09-23T08:50:57Z","snapshot_observed_at":"2026-08-15T08:10:28.606657Z","submitted_at":"2018-09-23T08:50:57Z","title":"Self Attention Grid for Person Re-Identification","version":1},"cited_work":{"arxiv_id":"1809.08556","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.08556","snapshot_observed_at":"2026-08-14T10:57:56.081032Z","title":"Self Attention Grid for Person Re-Identification","venue":"cs.CV","work_id":"c555d9bc-fa4c-4583-92fa-e2490100d612","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.588839Z"},"links":{"cited_paper":"/paper/1809.08556","citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:ca9835d7294d3a8e9cb8150cf1398f7eba906c66a191c1f86a6fb4550b711f25","observation_id":"69f7d90b-47b6-41b4-8a0d-2a0325ad34b8","resolution":{"observed_at":"2026-08-14T10:57:56.086165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.594467Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.594467Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:4078027d82d093db37dd259f1051a4e169972b427c6024c25a872dd148d1e7b0","observation_id":"37f63122-2244-429c-bdbc-a273ee5c049f","resolution":{"observed_at":"2026-08-14T10:57:55.594467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.815361Z","title":"Video person re-identiﬁcation with compet- itive snippet-similarity aggregation and co-attentive snippet embedding","venue":null,"work_id":"9a8a737e-88fa-419d-b455-2bc23bfdd588","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.599345Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:0d2fe8b68e52a40e1ced577cdd0be6fb763065ddd588b16d0ca064a3a71e1635","observation_id":"3bc1c7ce-e246-4870-b02b-e4e3046111f4","resolution":{"observed_at":"2026-08-14T10:57:56.820315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.801198Z","title":"Deeplab: Semantic im- age segmentation with deep convolutional nets, atrous con- volution, and fully connected crfs","venue":null,"work_id":"e7f988c5-e6ad-4ffb-a243-122bb850f5ca","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.604314Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:b8487ed61736391055112717beca404c8ea022203c3a3f4e7e4bce99e7cd6788","observation_id":"2a88a4f3-484c-4d13-864a-06aa9c4ee7e9","resolution":{"observed_at":"2026-08-14T10:57:56.805884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.786193Z","title":"A two stream siamese convolutional neural network for person re-identiﬁcation","venue":null,"work_id":"4221be09-c5ed-49a3-9a65-e85426891b9f","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.609223Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:97bac1879add0bb2fe90c0c3e30ade18fe2c3e719143a8a909f64cacbda65ca0","observation_id":"b3ad617c-9c2f-4788-95e3-8d737ca325a4","resolution":{"observed_at":"2026-08-14T10:57:56.790995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.770062Z","title":"Gmmcp tracker: Globally optimal generalized maximum multi clique problem for multiple object tracking","venue":null,"work_id":"df3cf498-3088-40fd-b98a-7fb1b554530d","year":2015},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.613822Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:32ad40a6d6c9478eca0702148c6081c1e8bbbe855c39d098eeceef1fee88ad62","observation_id":"955526fb-d8b3-4d18-9434-daf9d2b0012f","resolution":{"observed_at":"2026-08-14T10:57:56.775458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.754076Z","title":"Spatiotemporal multiplier networks for video action recog- nition","venue":null,"work_id":"084d63d1-6fbf-4a6d-9e8f-551d5d29682f","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.619039Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:836631f5f4628a89e668cb7cd7bc7e670dcef8b07573b1d3daec919ba0dfaa7a","observation_id":"9db49b7c-04a3-4035-aeb8-60caf51e3090","resolution":{"observed_at":"2026-08-14T10:57:56.759067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.738818Z","title":"Convolutional two-stream network fusion for video action recognition","venue":null,"work_id":"165efbed-98ce-456e-b0e0-cabb9b4b85be","year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.623405Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:5945aada462a08d399e646a2d6f46985f1869c1a3bfdaae72563560b8dce087f","observation_id":"e9acafef-d277-4593-9858-75ea439c1fc1","resolution":{"observed_at":"2026-08-14T10:57:56.743976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.724138Z","title":"Object detection with discriminatively trained part-based models","venue":null,"work_id":"fcfed76e-83a3-475f-a53f-2761216377a8","year":2010},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.627805Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:c92e1e8faec212b9da864c81a504c3119f99e2d4a9be3cd2185d4ee68441efe0","observation_id":"57266e31-a0a9-47ce-a084-f0939c55ef85","resolution":{"observed_at":"2026-08-14T10:57:56.729224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.709536Z","title":"Dual attention network for scene segmentation","venue":null,"work_id":"3170480f-d399-48cb-b91e-019e0ebc6bb5","year":2019},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.632345Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:91569846d6eb82287aa3a3f4096001dd58430ab18f44679a33882dfe922734e1","observation_id":"ab4c35ba-1fe9-4bd0-8a12-e6dced815128","resolution":{"observed_at":"2026-08-14T10:57:56.714265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.694696Z","title":"Sta: Spatial-temporal attention for large-scale video- based person re-identiﬁcation","venue":null,"work_id":"7ed5ae04-a8d7-4d14-b6cb-c36f3c64480c","year":2019},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.636684Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:bcb8e671d94615cc135ed7551ba6453e744b9f548598ed3f2ea6513eef572e52","observation_id":"70c22c61-d2ab-4ef0-82c5-ffe86790d6c8","resolution":{"observed_at":"2026-08-14T10:57:56.699503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.641299Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.641299Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:5dc54bf86d5bc3f12c9799cca1f3c875c469fde26e5f0e6b704298ee41289cb4","observation_id":"de19f111-8e27-4618-84f7-abb38ff45f74","resolution":{"observed_at":"2026-08-14T10:57:55.641299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-14T21:10:31.788257Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-08-14T10:57:55.645723Z","title":"In de- fense of the triplet loss for person re-identiﬁcation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.645723Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:100b0359ab49e89b1ddbae168f7861a5da357ce58a208eb2a8eadd7411dbf5c2","observation_id":"66c4dbc5-c76e-4596-b9b2-0c898d51d829","resolution":{"observed_at":"2026-08-14T10:57:55.645723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.670917Z","title":"Person re-identiﬁcation by descriptive and discrim- inative classiﬁcation","venue":null,"work_id":"78717e90-0462-49bc-84a8-3838aefc1bfa","year":2011},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.650478Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:1f795c44cc01372ac550646dc4015a1d34244205f7881840f25c7af51cea1778","observation_id":"611e163d-273b-4eaa-8446-8f2e9838889d","resolution":{"observed_at":"2026-08-14T10:57:56.675647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.11721","last_updated":"2020-07-09T12:17:28Z","snapshot_observed_at":"2026-08-18T04:16:27.740097Z","submitted_at":"2018-11-28T18:18:27Z","title":"CCNet: Criss-Cross Attention for Semantic Segmentation","version":2},"cited_work":{"arxiv_id":"1811.11721","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.11721","snapshot_observed_at":"2026-08-14T10:57:56.041321Z","title":"CCNet: Criss-Cross Attention for Semantic Segmentation","venue":"cs.CV","work_id":"cfe61ba2-d35d-483f-a926-db4f15f5003d","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.655088Z"},"links":{"cited_paper":"/paper/1811.11721","citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:3121b3808a2cf9137acae79dec803f831e6bfd499a15049ae6983f7474801b51","observation_id":"00defd8d-f483-4da2-8e41-1b7aeb163795","resolution":{"observed_at":"2026-08-14T10:57:56.048063Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.656122Z","title":"Self-attention learning for person re-identiﬁcation","venue":null,"work_id":"6b891500-f87e-4f34-b67b-9d9d342d0266","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.659718Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:6e38e299f25ec6ffd24704df19dcd6090be7d33cea5095c692fea0534ffe55ac","observation_id":"3f3beece-7b70-4477-b915-cfdd8de2ec10","resolution":{"observed_at":"2026-08-14T10:57:56.660880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.664095Z","title":"Imagenet classiﬁcation with deep convolutional neural net- works","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.664095Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:f22e68091fdffa49d82c620531d9dd576e16f333d3ce5cf2e3a78685cb8fa03f","observation_id":"93504322-45bf-4107-83d6-ed358d61ac26","resolution":{"observed_at":"2026-08-14T10:57:55.664095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.631935Z","title":"Learning deep context-aware features over body and latent parts for person re-identiﬁcation","venue":null,"work_id":"12eae864-7c3d-4829-98ec-73a6632837de","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.668956Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:33c224cfdb53d7c79f9d2cda44703254e9f4ce956747c3cf8edaf09d454df28e","observation_id":"214a8a6f-bcfb-4e07-92b2-7a26d5762154","resolution":{"observed_at":"2026-08-14T10:57:56.636797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.616738Z","title":"Multi- scale 3d convolution network for video based person re- identiﬁcation","venue":null,"work_id":"c92521f8-1fe4-443f-89b5-d834920baaa6","year":2019},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.673554Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:ddfc5983446967a2da2220a56b54ba617aa8b376850417b782cde8363f489b2c","observation_id":"d6dec92b-0b61-44f6-8194-df8c2740f929","resolution":{"observed_at":"2026-08-14T10:57:56.621626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.600664Z","title":"Pose-guided representation learning for person re- identiﬁcation","venue":null,"work_id":"75579f3f-0d1d-47aa-a8a2-c8dfb43fd492","year":2019},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.677898Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:e792218bd4fec31ce7add9371218e01ac9e76aa4221ab632b8a9502d5bd869d8","observation_id":"8d28909e-af31-4c15-b6b8-01a0343a9db2","resolution":{"observed_at":"2026-08-14T10:57:56.605946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.681771Z","title":"Unsupervised person re-identiﬁcation by deep learning tracklet association","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.681771Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:085fc81c6d1e861db8794d0b6c33bd12ff378b685ec37a1862853a51523941a0","observation_id":"b21f5d21-f6a0-4408-abd9-571b552a4f4a","resolution":{"observed_at":"2026-08-14T10:57:55.681771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.575299Z","title":"Diversity regularized spatiotemporal attention for video- based person re-identiﬁcation","venue":null,"work_id":"2581d767-c27f-4e5f-bc30-ee837986dda1","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.685996Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:807a0018bd40175d69f4aa6d45cfd6fa9aceac3da25132f018732832dce8016a","observation_id":"4bbef5ef-f272-4d25-99b9-9655d212de7f","resolution":{"observed_at":"2026-08-14T10:57:56.580093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.560153Z","title":"Deep- reid: Deep ﬁlter pairing neural network for person re- identiﬁcation","venue":null,"work_id":"ebd6a396-bab0-471f-8f79-4113a3d8f5aa","year":2014},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.690223Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:2d546219cce06161fcb6cc0263e5d7ed47395062f1020023ad4f4c89c5b88ab4","observation_id":"b816a745-db55-4e52-9c53-3003a106c64b","resolution":{"observed_at":"2026-08-14T10:57:56.565021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.545545Z","title":"Harmonious at- tention network for person re-identiﬁcation","venue":null,"work_id":"83cc73cd-f56b-4a36-a819-6c1fef35163f","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.694639Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:124c36ede50a78b0a17eae73821f3cbb05b59d0e30ccb2ffa693d35678252f0e","observation_id":"2bf7d469-dd18-4852-81f1-a6b9614c632c","resolution":{"observed_at":"2026-08-14T10:57:56.550266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.531419Z","title":"Video-based person re-identiﬁcation by deep fea- ture guided pooling","venue":null,"work_id":"b96ecc3e-a410-4f67-a377-bc1973f85fe9","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.699102Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:b5b6517a6d48715e9f590533342f0e661c3b6a8639c4efca6800a31900cdac14","observation_id":"0ee0d672-90ff-4415-a6bf-e943a6bcd3c8","resolution":{"observed_at":"2026-08-14T10:57:56.535886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.517082Z","title":"Video-based person re-identiﬁcation with accumulative motion context","venue":null,"work_id":"2e51f63d-ea6d-474c-b654-e2d772b6c5c9","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.703237Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:c66383f96cb8ca80267468fa094e7cbd6c9e645784e8eaa34a79b7858f35d01e","observation_id":"d7a598cf-0f9f-4943-a35c-bd105ea7424d","resolution":{"observed_at":"2026-08-14T10:57:56.521982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.501810Z","title":"Dense 3d-convolutional neural network for person re-identiﬁcation in videos","venue":null,"work_id":"2866f523-0136-4406-af12-cc54fe50a701","year":2019},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.707605Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:c7716e097a251034476067ced99f2e4e2947e109181b949fad4f2ab3ef68dd10","observation_id":"c508d05b-931e-4314-940c-912f4358c061","resolution":{"observed_at":"2026-08-14T10:57:56.506993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.486420Z","title":"Qual- ity aware network for set to set recognition","venue":null,"work_id":"531ff61f-7038-4902-81cf-aef63b62a4c0","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.711913Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:54f4c176a12d90b2c6f67255931a2c38e0e8513153cee533744ffd5f3360b5d5","observation_id":"33972fa2-392e-4098-bd76-b1d8617b5213","resolution":{"observed_at":"2026-08-14T10:57:56.491151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.471314Z","title":"Spatial and temporal mutual promotion for video-based person re-identiﬁcation","venue":null,"work_id":"e4bfc317-5d0b-45af-829a-ba4cb244b632","year":2019},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.716491Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:5ce871d798d0855d61728275d3bf9cdcb2af7206c3b3ce9355bb3a21dce1d3dd","observation_id":"3b786d41-00b8-4b9a-897e-4695b7931d83","resolution":{"observed_at":"2026-08-14T10:57:56.476035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.456624Z","title":"Recurrent convolutional network for video- based person re-identiﬁcation","venue":null,"work_id":"2da3348f-2a04-476d-b7ce-56f79e4af0ce","year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.721154Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:a6d243598d8a443c9a85eee16ed95d044e2453f7a75212c0ffcda9879d927d78","observation_id":"19812ed3-f4ef-4e99-8367-ce3a20c27354","resolution":{"observed_at":"2026-08-14T10:57:56.461421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.441465Z","title":"Local ﬁsher discriminant analysis for pedestrian re-identiﬁcation","venue":null,"work_id":"0246fdec-e991-40bc-8e1a-e57a0455cf4a","year":2013},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.725689Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:48c6c9d49c6f73b433f72269ec672e5535ff386ae0631384417a366e1d690eae","observation_id":"bfb314ef-1f40-48de-88ed-457d1c822135","resolution":{"observed_at":"2026-08-14T10:57:56.446575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.425385Z","title":"Learning spatio- temporal representation with pseudo-3d residual networks","venue":null,"work_id":"232cdb78-4cff-4308-bdc5-a7a90cf6121e","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.730191Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:9fe4f81907a032fbffc278ccc4027637ac21183bff0a10f83758837f02747d1c","observation_id":"748eaa4c-a600-44e6-bdc1-a2228d44bf5b","resolution":{"observed_at":"2026-08-14T10:57:56.430353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.734526Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.734526Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:eeffbf1ec38f4929383b814a077221db074812bff9a402fa04d6b540a89ed162","observation_id":"8000a4a3-6c6d-4f71-848a-ca1fab78b608","resolution":{"observed_at":"2026-08-14T10:57:55.734526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.398910Z","title":"Performance measures and a data set for multi-target, multi-camera tracking","venue":null,"work_id":"7e3e1824-a02a-4301-8aa1-898dccb5d74e","year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.738773Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:1ec4b55b86ac6fb32dd90e696214d4ae423eeb1d10bcbaebe39319731078fa32","observation_id":"bc273470-55b4-4e74-a0a1-74b1c8e29122","resolution":{"observed_at":"2026-08-14T10:57:56.404425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.382896Z","title":"Dual attention matching network for context-aware feature sequence based person re-identiﬁcation","venue":null,"work_id":"a89e2884-d33d-446f-8c1f-60e785a4f3a7","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.743090Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:eb583b785e9108212827f5086f5307b5f1148b0053a1dd9599370f5d4d03cfc5","observation_id":"f0b6e9fa-bfb9-4552-9934-3f4a94a13783","resolution":{"observed_at":"2026-08-14T10:57:56.387998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.367409Z","title":"Two-stream con- volutional networks for action recognition in videos","venue":null,"work_id":"1749fed0-c0d6-4684-9d99-3bc9946c6cbc","year":2014},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.747737Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:15fd79edcc3c3971fb49fd0f1442ddf93fc1ef8c677c0a40572f7b52b88e876b","observation_id":"732c2b08-8f82-4fac-be37-fd99cb4ca69b","resolution":{"observed_at":"2026-08-14T10:57:56.372602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.352273Z","title":"Mask-guided contrastive attention model for person re-identiﬁcation","venue":null,"work_id":"8b394549-fc2e-4082-bc82-4da4166f0403","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.752173Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:3f75c8a1fc6d9b63a78652379303d962aeb537d576cc1ff510bcb3cc9efee9f5","observation_id":"c69f05af-596b-42ea-bd92-f171c5fca0ce","resolution":{"observed_at":"2026-08-14T10:57:56.357188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.337342Z","title":"Pose-driven deep convolutional model for per- son re-identiﬁcation","venue":null,"work_id":"c33e4bf8-45f5-429e-af60-d0669ff83fb0","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.756607Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:fbc5ee0dfc55b695f7b211ac3fbfe5a8ca3569bc6d3eb4057de6d313b3be45e7","observation_id":"a84c0df3-abef-44de-8621-91f9668bf9f5","resolution":{"observed_at":"2026-08-14T10:57:56.342018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.322956Z","title":"Part-aligned bilinear representations for per- son re-identiﬁcation","venue":null,"work_id":"529aca70-aab4-4ed1-bbbe-303b59b7cc02","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.760937Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:cae5ef34cee3b5e8be4c999fe13f8f35c3240afa784f1ad274517a2c01ac3523","observation_id":"995d27a0-e18c-4433-b8ea-f3ff8d9ac0fc","resolution":{"observed_at":"2026-08-14T10:57:56.327708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.765453Z","title":"Rethinking the inception ar- chitecture for computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.765453Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:7a49b76a99f1799ad94768c2f81da70b38a4348ef2fc636ebee8d937921966d3","observation_id":"d184404f-f98e-46dd-a0c7-344df6a560b6","resolution":{"observed_at":"2026-08-14T10:57:55.765453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.769804Z","title":"Learning spatiotemporal features with 3d convolutional networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.769804Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:667edd5a6b3c26c337484978471090a979597a426333f3d8abe4b389dec70f0e","observation_id":"6dc4ceda-8ce0-4fa1-b69f-85b90f673c4d","resolution":{"observed_at":"2026-08-14T10:57:55.769804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.287984Z","title":"Non-local neural networks","venue":null,"work_id":"bb583cc2-4615-407d-abb4-9f4b35f9a4b2","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.774150Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:34c552144d45163287309276019e127beab88c8966a7ca92d1fcc362c455e98c","observation_id":"1b69df48-b84d-4156-858b-33745c404d58","resolution":{"observed_at":"2026-08-14T10:57:56.293387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.273130Z","title":"Person re-identiﬁcation: System design and evaluation overview","venue":null,"work_id":"7aba7224-fdc3-4825-91ce-411d08aeefb8","year":2014},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.778687Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:8d2146fcace1bd61668d3ca58219a175b880b1fa2379a12bffdcc5bde76f3478","observation_id":"cecbfbd5-824e-4a0e-a901-918302e2e847","resolution":{"observed_at":"2026-08-14T10:57:56.277780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.257731Z","title":"Person transfer gan to bridge domain gap for person re- identiﬁcation","venue":null,"work_id":"0f04a287-7c2e-4cf1-8de4-b06064d8bd5e","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.889621Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:773f89f0673eb5ee1e01038b1193fa047737ef586c432183608c0218e271207b","observation_id":"dba9055d-c113-4a0c-8540-673cc2b09e68","resolution":{"observed_at":"2026-08-14T10:57:56.262784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.241790Z","title":"Glad: global-local-alignment descriptor for pedestrian retrieval","venue":null,"work_id":"a5289024-7d91-4281-815b-9f8764c7d1ec","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.894436Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:b7e43b273d05c3494126aacd39afbd97c25c247874e39a28b66a2a65d3e0dc6c","observation_id":"632187a4-27e1-4150-9861-8e39709bfce1","resolution":{"observed_at":"2026-08-14T10:57:56.246719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01609","last_updated":"2016-06-12T10:52:09Z","snapshot_observed_at":"2026-08-14T21:54:06.476979Z","submitted_at":"2016-06-06T04:29:16Z","title":"Deep Recurrent Convolutional Networks for Video-based Person Re-identification: An End-to-End Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01609","snapshot_observed_at":"2026-08-14T10:57:55.898885Z","title":"Deep recurrent convolutional networks for video-based person re-identiﬁcation: An end-to-end ap- proach","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.898885Z"},"links":{"cited_paper":"/paper/1606.01609","citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:bbc4bd6581311935ac71bc6c8107ba20b57ace4a8b0d5615d4a7bf4bf41aa190","observation_id":"45a4e865-ba56-46de-a270-644fca01fec3","resolution":{"observed_at":"2026-08-14T10:57:55.898885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.226568Z","title":"Exploit the unknown gradually: One-shot video-based person re-identiﬁcation by stepwise learning","venue":null,"work_id":"e0c109d2-8766-4afb-8757-ddbcefb78f38","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.903723Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:89a4f70319adcfdccd1c10d8cdbcc4987537a6a389b5d4fb98c9262a18ed8d3a","observation_id":"f0e066af-6a5e-4374-85a1-ef025f99dbfc","resolution":{"observed_at":"2026-08-14T10:57:56.231519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.211962Z","title":"Temporal-enhanced convolutional network for person re- identiﬁcation","venue":null,"work_id":"0206ab9c-3477-4db2-9dc5-cf8f3ba9290a","year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.908285Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:fb163fd327fc6864265130c05095611b966fbfd6c48a5d173f38b9057d1a0646","observation_id":"ce70e466-2f75-4453-9f8a-fa9b665d2a08","resolution":{"observed_at":"2026-08-14T10:57:56.216698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.197290Z","title":"Person re-identiﬁcation using kernel-based metric learning methods","venue":null,"work_id":"59e93680-2180-483e-816a-fdefd5af257b","year":2014},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.912816Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:568b52bed2e09fe6d4a0a964fc8137d0bf61759699bcd253af9fca67cad4901c","observation_id":"73bc1290-e2ef-4756-93c8-763ae937f498","resolution":{"observed_at":"2026-08-14T10:57:56.202019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.182379Z","title":"Person re-identiﬁcation via recurrent feature aggregation","venue":null,"work_id":"0beed2fa-ce0c-4353-ac15-d5b8f020df4f","year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.917348Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:22cc5fb06131dc8d0a490bc9a0ffb1c61cd378f0c7c89717267dbf8080d08de9","observation_id":"b49c432e-e8c3-4b7e-8ee3-b78b98aa9f9b","resolution":{"observed_at":"2026-08-14T10:57:56.187267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.921999Z","title":"Denseaspp for semantic segmentation in street scenes","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.921999Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:837685c0b39264006f2f7f7c78d4991c8f46f06a92309697d83a361af2b0390f","observation_id":"87be80b0-fa8e-41c1-b94d-69810606d84b","resolution":{"observed_at":"2026-08-14T10:57:55.921999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07122","last_updated":"2016-04-30T18:19:37Z","snapshot_observed_at":"2026-08-17T22:45:12.497845Z","submitted_at":"2015-11-23T07:32:14Z","title":"Multi-Scale Context Aggregation by Dilated Convolutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07122","snapshot_observed_at":"2026-08-14T10:57:55.926882Z","title":"Multi-scale context aggregation by dilated convolutions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.926882Z"},"links":{"cited_paper":"/paper/1511.07122","citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:22cb52354891986858423177726d7fdd4656a4aaf0deeab92e0c5db3e2e63b09","observation_id":"b21e7868-8a40-44cf-866c-a571e5749e2d","resolution":{"observed_at":"2026-08-14T10:57:55.926882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00916","last_updated":"2021-03-15T03:27:54Z","snapshot_observed_at":"2026-08-14T18:33:19.424820Z","submitted_at":"2018-09-04T12:22:10Z","title":"OCNet: Object Context Network for Scene Parsing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00916","snapshot_observed_at":"2026-08-14T10:57:55.931501Z","title":"Ocnet: Object context net- work for scene parsing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.931501Z"},"links":{"cited_paper":"/paper/1809.00916","citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:7ab3ec3d4f055b3c4b1ce5d6aae69e8f0d71f747f765bad36847c6d991644a3d","observation_id":"27e8a707-77ea-4252-ab9e-7dcbc2f794ba","resolution":{"observed_at":"2026-08-14T10:57:55.931501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.936267Z","title":"Pyramid scene parsing network","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.936267Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:698a5ab7fd6a2c58d8e281b1e0cfabf0e0f10a9812d248319b13f64893a9e453","observation_id":"2e0b1704-2e3f-44bf-badb-d3a980a67192","resolution":{"observed_at":"2026-08-14T10:57:55.936267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.147407Z","title":"Deeply-learned part-aligned representations for person re- identiﬁcation","venue":null,"work_id":"f609c3e2-d2b5-4833-8d99-b1ae55336ffc","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.940595Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:ad5697fd2a3ba5929406ae77462d42572e16a1dd5e09888fb605d386c99425c0","observation_id":"9f23a847-349b-44cf-b63a-f08815964109","resolution":{"observed_at":"2026-08-14T10:57:56.152333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.945124Z","title":"Mars: A video benchmark for large-scale person re-identiﬁcation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.945124Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:d28a34a94dc5d43077ee341c0beb14d43a8675f06276e1fd8d3558b40d848f28","observation_id":"72e5e0b8-905e-4665-afd2-23efce580ec3","resolution":{"observed_at":"2026-08-14T10:57:55.945124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:55.949298Z","title":"Scalable person re-identiﬁcation: A benchmark","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.949298Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:7772df72723108c5401666d1c772241a8c3994600983f5d432dd40c4f62168bb","observation_id":"8f1a9290-5d5a-45c8-a337-c09e05c065bb","resolution":{"observed_at":"2026-08-14T10:57:55.949298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.112068Z","title":"Re- ranking person re-identiﬁcation with k-reciprocal encoding","venue":null,"work_id":"8759b5c2-96c6-47f8-87e5-bf2ac3e57d02","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.953649Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:5d6141c255425050318e20c5928407c085be4b474d883a32a4afd24c5c056225","observation_id":"42fda620-0e93-4273-887e-84efb3fa27b2","resolution":{"observed_at":"2026-08-14T10:57:56.116899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:57:56.097072Z","title":"See the forest for the trees: Joint spatial and tem- poral recurrent neural networks for video-based person re- identiﬁcation","venue":null,"work_id":"bfe8c491-74bf-4f5d-90db-c6affd1a2fa0","year":2017},"citing_paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T10:57:55.958198Z"},"links":{"citing_paper":"/paper/1908.10049"},"observation_digest":"sha256:5cc1b1e4f15a0b25d72b2ac13973c7f984173ab9c38f077544b70ea3407ffa08","observation_id":"eed95f7e-f1c1-460f-a8b8-a3f5bd38e310","resolution":{"observed_at":"2026-08-14T10:57:56.101944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.10049","last_updated":"2019-08-27T06:57:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T00:09:23.564842Z","submitted_at":"2019-08-27T06:57:03Z","title":"Global-Local Temporal Representations For Video Person Re-Identification"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":42},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:1908.10049."}