{"as_of":"2026-08-20T05:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbc6dea192ae23a14f5dc60adbf08c5ee82f1ed5d3c905f1cfd1f6a964e7bef6","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:51:18.477744Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.06368/citation-record","integrity":"/paper/1908.06368/integrity","json":"/paper/1908.06368/citation-record.json","paper":"/paper/1908.06368"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.625865Z","title":"https://deepdrive.berkeley.edu/project/low- latency-deep-inference-self-driving-vehicles","venue":null,"work_id":"7c5248dd-42f2-4f58-adea-5fdff81c2207","year":null},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.201026Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:07220d91ba9ed4cd17e4d3359470b88e8dd0dfbb4feed1c581dc9414decb7820","observation_id":"d4fb9779-9b7c-4d7d-ae72-4a0d0407ee58","resolution":{"observed_at":"2026-08-14T12:51:19.632056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.597774Z","title":"Object detection in video with spatiotemporal sampling networks","venue":null,"work_id":"48409126-3a40-4ea3-a685-458361029884","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.214260Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:d52b7814645cab47ab0ce3dbecf524fb9e5c1990a43a1404215ed9b92bd1b100","observation_id":"26bd4cd8-7bff-4496-b633-26ba1d979428","resolution":{"observed_at":"2026-08-14T12:51:19.607907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.574229Z","title":"Adaptive neural networks for efﬁcient inference","venue":null,"work_id":"3c0d5b3b-ce61-48a2-bbb6-6beed3bcd4ad","year":2017},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.228687Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:6fcae8d2ca6b399a430b2f807c0ca67e18ad0787652befbec8f59072777d340d","observation_id":"1604b891-7947-4c73-816c-5bb6dff18cb8","resolution":{"observed_at":"2026-08-14T12:51:19.582013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.547680Z","title":"Optimizing video object detection via a scale-time lattice","venue":null,"work_id":"47b3b0b8-d9c4-4477-b85d-77708b6ab7ae","year":null},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.236400Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:3f99ecf0964b188c608a2b52ab0a30572cd9faa458978428456e68e7ef2118a1","observation_id":"7285bee3-becc-4f91-a38e-df997954a20d","resolution":{"observed_at":"2026-08-14T12:51:19.553712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.522990Z","title":"R-FCN: Object detection via region-based fully convolutional networks","venue":null,"work_id":"3f0ae9fe-47ec-48fb-921a-80ddf114cd0b","year":2016},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.242646Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:ed7144578aa8e81843be9fffd30b8c6ae17062d797195db4baf8cced4e280c70","observation_id":"ac81de19-c9ce-428c-9de6-257e94c052a9","resolution":{"observed_at":"2026-08-14T12:51:19.533222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.253260Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.253260Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:285dc3af14a57c90cf470f2d329c0bfde00eba354e99416cf8cefa0d76aad04a","observation_id":"bb9250fa-8881-46e5-ae67-f7a41033eb20","resolution":{"observed_at":"2026-08-14T12:51:18.253260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.479580Z","title":"The pascal visual object classes (VOC) challenge","venue":null,"work_id":"db452cab-89a3-4ef9-86b2-14760708f243","year":2010},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.258594Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:42f350c179e33808e177a62f7ec0ce54d2985962c39f71fa9f44d3d347409064","observation_id":"c8cd2d78-7f03-4abf-80fd-e90e27469de1","resolution":{"observed_at":"2026-08-14T12:51:19.487989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.451405Z","title":"Detect to track and track to detect","venue":null,"work_id":"0ca5ddf4-cc2e-4a6f-be71-a564adc57974","year":2017},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.264999Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:5ff36a4decea7712cc06b9ad0917285cfd1bef5a5b686930347fefda04438634","observation_id":"f006c723-b25f-4535-8353-82d34bcc6fd0","resolution":{"observed_at":"2026-08-14T12:51:19.457109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.418395Z","title":"Vision meets robotics: The KITTI dataset","venue":null,"work_id":"99714d34-5f1c-41ee-898d-43a240c01026","year":2013},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.270624Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:78e2fd0e3fbe7ef166faf57496bb896a8e7cac39519fdecda243b43367106663","observation_id":"26994ec8-d680-4f57-be1a-cb205c565f7f","resolution":{"observed_at":"2026-08-14T12:51:19.424024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05896","last_updated":"2017-12-16T02:53:30Z","snapshot_observed_at":"2026-08-14T20:03:06.078421Z","submitted_at":"2017-12-16T02:53:30Z","title":"Impression Network for Video Object Detection","version":1},"cited_work":{"arxiv_id":"1712.05896","doi":null,"metadata_source":"pith","pith_arxiv_id":"1712.05896","snapshot_observed_at":"2026-08-14T12:51:18.691909Z","title":"Impression Network for Video Object Detection","venue":"cs.CV","work_id":"832ff5f1-5f24-4e0b-a45b-8e68aae16e11","year":2017},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.277820Z"},"links":{"cited_paper":"/paper/1712.05896","citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:1c31c6e698d0344250050fe4d6b95a5604b76b678a3e42892382f605dffccb9f","observation_id":"07e62fb9-3a60-477d-a1d7-52c523d5f7e7","resolution":{"observed_at":"2026-08-14T12:51:18.707861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-14T12:51:18.285977Z","title":"MobileNets: Efﬁcient con- volutional neural networks for mobile vision applications","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.285977Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:e94e66b27ddb0a5fcc07bf85645e37493e213fe9e0b42530885069adc38c5b90","observation_id":"b3154daf-ca20-44db-a7ff-6cc36de95f33","resolution":{"observed_at":"2026-08-14T12:51:18.285977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.393321Z","title":"T-CNN: Tubelets with convolutional neural networks for object detection from videos","venue":null,"work_id":"b5c3e204-e3eb-43a0-9c7e-5b1b49f5030b","year":null},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.298449Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:383fdd033f15601c9390029bdd21e3b6c33a096230e517f2c4e14eb1222326d6","observation_id":"06c94e81-6510-41fc-a9d0-7825f201b59c","resolution":{"observed_at":"2026-08-14T12:51:19.399891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.358892Z","title":"A discriminative model with multiple temporal scales for action prediction","venue":null,"work_id":"72eade65-25ca-4db2-ae4d-db92127dee7b","year":2014},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.304485Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:5a60e269902faf53b8248b757db85af6635cfbcb840fc3f66470998e75d0f692","observation_id":"284f985c-06c3-4679-9acb-c3e6ccb36824","resolution":{"observed_at":"2026-08-14T12:51:19.368240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07369","last_updated":"2016-05-24T10:40:13Z","snapshot_observed_at":"2026-08-14T21:56:01.429225Z","submitted_at":"2016-05-24T10:40:13Z","title":"Quickest Moving Object Detection","version":1},"cited_work":{"arxiv_id":"1605.07369","doi":null,"metadata_source":"pith","pith_arxiv_id":"1605.07369","snapshot_observed_at":"2026-08-14T12:51:18.628311Z","title":"Quickest Moving Object Detection","venue":"cs.CV","work_id":"c1fc0be4-fd07-4c8b-b190-c055f432da65","year":2016},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.310750Z"},"links":{"cited_paper":"/paper/1605.07369","citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:6f22124a589d4fef2ed23a7476eaf23742ec3d2fc8da0faf05cc1c7a2c04ab7a","observation_id":"9c305175-169e-4a0d-befb-ae58d84e9cb5","resolution":{"observed_at":"2026-08-14T12:51:18.637135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.335548Z","title":"Minimum delay ob- ject detection from video","venue":null,"work_id":"52598b2e-7ad9-4c8c-9dde-f73f148cda22","year":null},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.316539Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:b312affef9a2dcca94d63d9ba9abc2009cc57d5f62c8fd54f86e756cdc32e8b8","observation_id":"0e0a6355-8d3b-4cc2-913a-dc9e04e0e271","resolution":{"observed_at":"2026-08-14T12:51:19.341775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.309355Z","title":"Evaluating real-time anomaly detection algorithms–the numenta anomaly bench- mark","venue":null,"work_id":"1d351e98-f9cf-4584-9dcd-bbf73d24bb06","year":2015},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.321665Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:5feefd0fcaaa4773521d964933fc2bb76cd2794278c20b535b4bb3ffec7bb072","observation_id":"3336ee03-43b2-4e36-ad8d-a7c6ee4cce09","resolution":{"observed_at":"2026-08-14T12:51:19.316351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.278426Z","title":"The ar- chitectural implications of autonomous driving: Constraints and acceleration","venue":null,"work_id":"719f0661-16e2-4a13-a2ff-de634797a782","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.327409Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:023779097b573c27560d01c36d6c385b22878b4205b9f45ed34a520db614fc51","observation_id":"c20b251b-e95f-4a32-b5ce-6a7b9eacd8c9","resolution":{"observed_at":"2026-08-14T12:51:19.286516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.332518Z","title":"Focal loss for dense object detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.332518Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:9866ccbfc5dc939573792d5bb9eeec9807ea3d4368611586cb0850f1198ad62c","observation_id":"2e9ceaa4-ff33-4a79-96c0-1ca93a1f642c","resolution":{"observed_at":"2026-08-14T12:51:18.332518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.238369Z","title":"Microsoft CoCo: Common objects in context","venue":null,"work_id":"7b21a711-5a96-4a46-810d-2c71b66cbbfc","year":2014},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.337644Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:e99626708f7d0e34320b62cd156416f14de6b2a507bc892c4b047464fc3b87d1","observation_id":"2c69312b-6c8c-458f-8d2e-546874bae6a6","resolution":{"observed_at":"2026-08-14T12:51:19.245258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.212149Z","title":"Mobile video object detec- tion with temporally-aware feature maps","venue":null,"work_id":"ab22c4bc-af8c-4680-a3fb-3692e8265fbc","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.342813Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:f3cc66c388c82bcd0e78460ff061d7c19c8d54774919ec0a8a964bdaec1311a1","observation_id":"b748c408-a37b-428b-8440-1277f013c8e4","resolution":{"observed_at":"2026-08-14T12:51:19.220535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.185091Z","title":"SSD: Single shot multibox detector","venue":null,"work_id":"755df2e5-e591-4930-a761-1799b0b0f877","year":2016},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.348131Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:dbf236b188ce16409c25197c9c1bb17968915ece319a6fdc14605d42ce504341","observation_id":"019aa1bb-fde3-4c75-a67d-894339640cae","resolution":{"observed_at":"2026-08-14T12:51:19.195073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.156631Z","title":"Detect or track: Towards cost-effective video object detec- tion/tracking","venue":null,"work_id":"04c4c940-4e85-4090-940b-df5efc50d1c2","year":2019},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.354053Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:46f444746dbe09fa70cac86a9b21cb34ee4e60d3483830f0019002a34b16ce3c","observation_id":"a66281bd-43d4-4181-aac4-453115c068f8","resolution":{"observed_at":"2026-08-14T12:51:19.167025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.128989Z","title":"Learning ac- tivity progression in LSTMs for activity detection and early detection","venue":null,"work_id":"c0214181-10e5-484d-9b74-cdf6b1c9d2a9","year":2016},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.360135Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:5aff09cf7632e2077b1250e678d92b45a6c8f414036af106a21ddedd652f4098","observation_id":"0e022102-bc8a-4fba-b822-3b26e38418bc","resolution":{"observed_at":"2026-08-14T12:51:19.140830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.089623Z","title":"Budget-aware activity detection with a recurrent policy network","venue":null,"work_id":"beb4f070-9951-484b-83e3-5f2a41cc822b","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.366496Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:f158d4fdb72bbe25b031704b6df90e1278692a922dec024591090c1a8062d367","observation_id":"63c2ee0d-eb65-43f1-aa66-eb632fad07a6","resolution":{"observed_at":"2026-08-14T12:51:19.100493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00434","last_updated":"2019-02-19T18:57:18Z","snapshot_observed_at":"2026-08-14T18:21:28.440491Z","submitted_at":"2018-09-30T17:59:42Z","title":"CaTDet: Cascaded Tracked Detector for Efficient Object Detection from Video","version":2},"cited_work":{"arxiv_id":"1810.00434","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.00434","snapshot_observed_at":"2026-08-14T12:51:18.580967Z","title":"CaTDet: Cascaded Tracked Detector for Efficient Object Detection from Video","venue":"cs.CV","work_id":"c15fa7d1-b726-4276-b76c-8e0265f94956","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.377729Z"},"links":{"cited_paper":"/paper/1810.00434","citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:110d6f89ac14c8e6195de3080986873ba7f5641b8f651e9afdb1a1aa01ad6414","observation_id":"e755f1a4-3b67-4fe3-9ae1-e1f5c4392b63","resolution":{"observed_at":"2026-08-14T12:51:18.599602Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.061061Z","title":"Towards real-time object detection on embedded systems","venue":null,"work_id":"a6d2ce21-0d50-4c27-a859-a378217618a5","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.387957Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:69b354fd4b6d72e412726d0e2a61b0597aae72ba332a2bc9ce468b7360296dec","observation_id":"2d3ab68a-f701-4618-846b-593f03bccad8","resolution":{"observed_at":"2026-08-14T12:51:19.069033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:19.028889Z","title":"Moped: A scalable and low latency object recognition and pose estimation system","venue":null,"work_id":"0b3c6d98-90cc-4b33-b9e6-96d210db4672","year":2010},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.397100Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:8faaee33f26334485ff07e7aff81ff374ae80e2bb9d8fe0fa150b9ca864f9480","observation_id":"c7364cce-b270-4d8b-800c-ec6e7fb3e594","resolution":{"observed_at":"2026-08-14T12:51:19.042894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.989467Z","title":"A large- scale benchmark dataset for event recognition in surveillance video","venue":null,"work_id":"59643892-5dfc-4a3c-971c-727c8071ea50","year":2011},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.403494Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:283d46245c8d56fa4de79b38cf6d7497eac6648f58d0e52e68a5e8a8f9ee899d","observation_id":"2dffad2a-18ad-4e02-b757-b941e4f67047","resolution":{"observed_at":"2026-08-14T12:51:18.997070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.962928Z","title":"Quickest detection","venue":null,"work_id":"7e1c63d4-a577-4d98-86cb-f767f56a0313","year":null},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.411046Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:7e5f6dd1cd5aca4887a1266a73d1c8288d53b2e9c2a85d45313bf3ff0ba905fd","observation_id":"decca832-e7a2-4ff6-8f7b-1d4a9e041b82","resolution":{"observed_at":"2026-08-14T12:51:18.968218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.942976Z","title":"YouTube-BoundingBoxes: A large high-precision human-annotated data set for object detection in video","venue":null,"work_id":"c21ac8d5-0592-4986-8e56-300c3c707b6d","year":2017},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.417952Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:cbb34dfd65da3d19efe5e31702c075ae6737297b9602bf5b0548ce46323c733f","observation_id":"b44889f5-6299-4731-b7c1-637f8d4a04ec","resolution":{"observed_at":"2026-08-14T12:51:18.948410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.427923Z","title":"Faster R-CNN: Towards real-time object detection with re- gion proposal networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.427923Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:c9d4b2505a81d36a44be9684d8407b915c26071f4b104a051dfd50a900c6833e","observation_id":"a790403b-1fae-467c-b39b-08ec77489d53","resolution":{"observed_at":"2026-08-14T12:51:18.427923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.902203Z","title":"Encouraging LSTMs to anticipate actions very early","venue":null,"work_id":"31381418-7c7f-4c23-abb8-54e2749eec45","year":2017},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.434581Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:1d9aacd9e6a94131689c583e716daeda8e7728841dfe663983c1557f7cb05c88","observation_id":"4d8940d0-d94f-40a4-9c9e-b8079026bf9b","resolution":{"observed_at":"2026-08-14T12:51:18.910519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.868341Z","title":"Mul- tilayer and multimodal fusion of deep neural networks for video classiﬁcation","venue":null,"work_id":"59b90c66-c288-42d7-8900-8931c088f28d","year":2016},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.440298Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:85b70f810ee82e0419f11790859337f1c86fcf6ba5983d65a3249a803b236501","observation_id":"1524b99b-a5c4-4a2a-8314-fe64444c84b4","resolution":{"observed_at":"2026-08-14T12:51:18.883180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.845888Z","title":"Making convolutional networks recurrent for visual sequence learn- ing","venue":null,"work_id":"606c2087-f254-44df-8f0d-c7b39afc4cfd","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.445874Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:12a35760557a7386587e1690e75879c0ba0e78d0a5a16ac05b8e7c7d90a6d3bb","observation_id":"58e5d355-5db9-4859-adcc-6a89b6b1fe46","resolution":{"observed_at":"2026-08-14T12:51:18.852931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.822933Z","title":"STEP: Spatio-temporal pro- gressive learning for video action detection","venue":null,"work_id":"f422681a-446a-4cf3-bafc-deb9b36a85fa","year":2019},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.450684Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:73ee2b89c380e1a8a7153428aeae94658c1d7f1b645a117e26b92a02fc6c1d10","observation_id":"ed256fb9-620c-4bf6-8468-caa82c7b46d4","resolution":{"observed_at":"2026-08-14T12:51:18.832383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04687","last_updated":"2020-04-08T09:25:06Z","snapshot_observed_at":"2026-08-14T19:16:08.121001Z","submitted_at":"2018-05-12T09:24:21Z","title":"BDD100K: A Diverse Driving Dataset for Heterogeneous Multitask Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04687","snapshot_observed_at":"2026-08-14T12:51:18.460593Z","title":"BDD100K: A diverse driving video database with scalable annotation tool- ing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.460593Z"},"links":{"cited_paper":"/paper/1805.04687","citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:f03a7ab905c4805a1d5d310af93dc021b3f459ec2daafe252397cec3dffe7589","observation_id":"31aa2bae-64c7-43d8-927d-c6c721eac6d7","resolution":{"observed_at":"2026-08-14T12:51:18.460593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.785179Z","title":"ShufﬂeNet: An extremely efﬁcient convolutional neural net- work for mobile devices","venue":null,"work_id":"319a0c42-60b3-429f-9e6e-a9448fc3a7fd","year":2018},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.466383Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:53f0291ddba6706603cf1c2ad6b2fa2cc05bc54f44308aa285d2a569c1e3fb64","observation_id":"2894fb2b-7d54-4564-9537-df4408e2d649","resolution":{"observed_at":"2026-08-14T12:51:18.796826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.758007Z","title":"Flow-guided feature aggregation for video object de- tection","venue":null,"work_id":"92728ffd-f38b-412a-a9b2-b6fa3199c475","year":2017},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.472305Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:4a27e73be10b9b69baa80ac2a64146c3b619edcf50744c5bcd1b568149d0f778","observation_id":"5191227e-b567-41c9-86f2-ae3de84d5491","resolution":{"observed_at":"2026-08-14T12:51:18.766683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:51:18.729484Z","title":"Deep feature ﬂow for video recognition","venue":null,"work_id":"26f52502-7c89-4043-bc0c-8a3e44495d3d","year":null},"citing_paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:18.477744Z"},"links":{"citing_paper":"/paper/1908.06368"},"observation_digest":"sha256:c23ffdd8b7f525decb001888942a02a822bc84a473116265c56051fb839a312a","observation_id":"0477d9b8-4601-43b5-9fc5-6588441b7c1b","resolution":{"observed_at":"2026-08-14T12:51:18.737946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.06368","last_updated":"2019-11-06T22:50:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T22:35:28.937186Z","submitted_at":"2019-08-18T03:36:23Z","title":"A Delay Metric for Video Object Detection: What Average Precision Fails to Tell"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":3,"verified_fuzzy":31},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:1908.06368."}