{"as_of":"2026-08-23T14:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:391665de8c22dc5735696b0b96bb5654eac31ad5146812a9adbab95954449968","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:43:07.905464Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.04519/citation-record","integrity":"/paper/1908.04519/integrity","json":"/paper/1908.04519/citation-record.json","paper":"/paper/1908.04519"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.06539","last_updated":"2019-08-06T12:47:41Z","snapshot_observed_at":"2026-08-22T08:29:07.828796Z","submitted_at":"2019-04-13T12:56:17Z","title":"HAKE: Human Activity Knowledge Engine","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.06539","snapshot_observed_at":"2026-08-14T13:43:07.666441Z","title":"HAKE: human activity knowledge engine","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.666441Z"},"links":{"cited_paper":"/paper/1904.06539","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:67852fc80a42c9d629ed12737a348933c41b9db89466163a8ad394965e0ed050","observation_id":"b3dd9061-69ac-4eac-966d-86fa92ba462a","resolution":{"observed_at":"2026-08-14T13:43:07.666441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.0767","last_updated":"2015-10-07T01:29:12Z","snapshot_observed_at":"2026-08-22T08:27:47.925683Z","submitted_at":"2014-12-02T03:05:54Z","title":"Learning Spatiotemporal Features with 3D Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.0767","snapshot_observed_at":"2026-08-14T13:43:07.684018Z","title":"Bourdev, Rob Fergus, Lorenzo Torresani, and Manohar Paluri","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.684018Z"},"links":{"cited_paper":"/paper/1412.0767","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:150520a968d83699ec4391d80d72ad09338955af310879860891b8656249566c","observation_id":"d2e48afa-0710-4f2e-a769-e14fcc791f10","resolution":{"observed_at":"2026-08-14T13:43:07.684018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.10305","last_updated":"2017-11-28T14:24:18Z","snapshot_observed_at":"2026-08-18T22:55:58.079696Z","submitted_at":"2017-11-28T14:24:18Z","title":"Learning Spatio-Temporal Representation with Pseudo-3D Residual Networks","version":1},"cited_work":{"arxiv_id":"1711.10305","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.10305","snapshot_observed_at":"2026-08-14T13:43:08.859818Z","title":"Learning Spatio-Temporal Representation with Pseudo-3D Residual Networks","venue":"cs.CV","work_id":"a17fa708-def6-4989-8f01-19f65c4a3dd3","year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.697859Z"},"links":{"cited_paper":"/paper/1711.10305","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:d45354a9f29b72c259d45071f3b228f3f6cd581b9f81690c71f47eab46238f53","observation_id":"be86eac4-0c5b-40b8-ab17-e26cd425cc95","resolution":{"observed_at":"2026-08-14T13:43:08.872055Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.04851","last_updated":"2018-07-27T03:20:56Z","snapshot_observed_at":"2026-08-22T08:29:09.307154Z","submitted_at":"2017-12-13T16:40:55Z","title":"Rethinking Spatiotemporal Feature Learning: Speed-Accuracy Trade-offs in Video Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.04851","snapshot_observed_at":"2026-08-14T13:43:07.707481Z","title":"Rethinking spatiotemporal feature learning for video understanding","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.707481Z"},"links":{"cited_paper":"/paper/1712.04851","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:6bc02868455d9d1687a34b56739de6206dcfecc9d7c21608975369ee640632c0","observation_id":"e2bbf8a4-30d0-4adf-a10f-b1512fcbdfe0","resolution":{"observed_at":"2026-08-14T13:43:07.707481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07750","last_updated":"2018-02-12T17:10:11Z","snapshot_observed_at":"2026-08-14T20:59:05.330633Z","submitted_at":"2017-05-22T13:57:53Z","title":"Quo Vadis, Action Recognition? A New Model and the Kinetics Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07750","snapshot_observed_at":"2026-08-14T13:43:07.720229Z","title":"Quo vadis, action recognition? A new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.720229Z"},"links":{"cited_paper":"/paper/1705.07750","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:5a2aae5ba89f7e08a53d89cafc67b6f69c6a236648e8f72084dc8ffed00ca7f0","observation_id":"72fed04d-7d93-4aed-a466-5c93098ed70d","resolution":{"observed_at":"2026-08-14T13:43:07.720229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03982","last_updated":"2019-10-29T06:26:37Z","snapshot_observed_at":"2026-08-21T09:44:32.896617Z","submitted_at":"2018-12-10T18:59:07Z","title":"SlowFast Networks for Video Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03982","snapshot_observed_at":"2026-08-14T13:43:07.729695Z","title":"Slowfast networks for video recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.729695Z"},"links":{"cited_paper":"/paper/1812.03982","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:1b2406b4b7570add08fe13f5fa5e54ce9af67527ac1ef8a1574898eb7b8e3cd3","observation_id":"8552cb0d-75e2-4781-94b4-4557a986b755","resolution":{"observed_at":"2026-08-14T13:43:07.729695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-08-19T04:42:40.974785Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-14T13:43:07.745937Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.745937Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:87b486d5e37623defd0fe571e203d9378336982981c1d57c76d7da2edff0f6d7","observation_id":"867c5d3e-9fc8-4652-92cc-7bbdb3776942","resolution":{"observed_at":"2026-08-14T13:43:07.745937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07971","last_updated":"2018-04-13T06:40:44Z","snapshot_observed_at":"2026-08-14T20:11:21.532523Z","submitted_at":"2017-11-21T18:51:16Z","title":"Non-local Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.07971","snapshot_observed_at":"2026-08-14T13:43:07.754325Z","title":"Girshick, Abhinav Gupta, and Kaiming He","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.754325Z"},"links":{"cited_paper":"/paper/1711.07971","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:211187ba7414702d15fb25f92c567bf469a121382e6c6c58ff65fb4370ed5702","observation_id":"f6cbf1ec-6f80-43fc-adce-aa2575645383","resolution":{"observed_at":"2026-08-14T13:43:07.754325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02707","last_updated":"2019-05-17T14:17:25Z","snapshot_observed_at":"2026-08-14T17:47:20.903346Z","submitted_at":"2018-12-06T18:42:25Z","title":"Video Action Transformer Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02707","snapshot_observed_at":"2026-08-14T13:43:07.768342Z","title":"Video action transformer network","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.768342Z"},"links":{"cited_paper":"/paper/1812.02707","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:d286a570a47422b2b3f804dbc746f47a0e534c67b4d6488fb0064b3761c87a5a","observation_id":"0fb3a362-7dd5-42e7-b12b-6324ec18ce0d","resolution":{"observed_at":"2026-08-14T13:43:07.768342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05038","last_updated":"2019-04-17T19:05:30Z","snapshot_observed_at":"2026-08-14T17:44:39.673967Z","submitted_at":"2018-12-12T17:13:55Z","title":"Long-Term Feature Banks for Detailed Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05038","snapshot_observed_at":"2026-08-14T13:43:07.775584Z","title":"Girshick","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.775584Z"},"links":{"cited_paper":"/paper/1812.05038","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:73792eca92052ed89d0ceb31a28a23abab4833fcc9b48a151af7bf10e4f31d90","observation_id":"2dc36ddd-6b5f-4f18-a765-b494687c3a91","resolution":{"observed_at":"2026-08-14T13:43:07.775584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-20T22:03:51.775198Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-14T13:43:07.793614Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.793614Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:4a739cc09d07cd9f279fb5d80bd84ec5a9b00efa655abd153d31824221c3f20d","observation_id":"d84c32b6-7dba-45ed-83e8-faca298ea32e","resolution":{"observed_at":"2026-08-14T13:43:07.793614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.01340","last_updated":"2018-08-03T20:17:05Z","snapshot_observed_at":"2026-08-15T17:51:24.030376Z","submitted_at":"2018-08-03T20:17:05Z","title":"A Short Note about Kinetics-600","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.01340","snapshot_observed_at":"2026-08-14T13:43:07.803303Z","title":"A short note about kinetics-600","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.803303Z"},"links":{"cited_paper":"/paper/1808.01340","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:a39c7c1e1f2e43a12c346f46a8724aee344e17b3e1641833883af1d362fbd1d7","observation_id":"605ccf17-8e2d-433b-90fc-107fe4256686","resolution":{"observed_at":"2026-08-14T13:43:07.803303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:43:09.086390Z","title":"Moments in time dataset: one million videos for event understanding","venue":null,"work_id":"458f8c0d-1394-4dce-abac-43658737d894","year":2019},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.811593Z"},"links":{"citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:d65cf72cc18a0444e0bd452ec823314769a7af0030e61140aca23eb2a4220bbf","observation_id":"408df1ac-c03b-4510-ad13-7b38a457154d","resolution":{"observed_at":"2026-08-14T13:43:09.102718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:43:09.054812Z","title":null,"venue":null,"work_id":"ceb5a2f8-44f5-4719-83cf-af3252ec6bbb","year":2015},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.817094Z"},"links":{"citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:5a769abf1806271363161298b03472ceeaa6e04b2f733f29e1f02642803bca5e","observation_id":"e3af1b65-53f7-4f46-8851-84dd85132ee9","resolution":{"observed_at":"2026-08-14T13:43:09.064335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:43:09.021976Z","title":"Sigurdsson, Gül Varol, Xiaolong Wang, Ali Farhadi, Ivan Laptev, and Abhinav Gupta","venue":null,"work_id":"b16e29e3-58c1-45fc-9753-ff30cbcea570","year":2016},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.827176Z"},"links":{"citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:48f8b01d9f8749e679a23945c4d5897c2b3dc9d41272726340070b7063aa30af","observation_id":"80870d81-521d-4112-adbc-a659ebb4b612","resolution":{"observed_at":"2026-08-14T13:43:09.031843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.08421","last_updated":"2018-04-30T17:45:11Z","snapshot_observed_at":"2026-08-14T20:58:42.421734Z","submitted_at":"2017-05-23T17:11:46Z","title":"AVA: A Video Dataset of Spatio-temporally Localized Atomic Visual Actions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.08421","snapshot_observed_at":"2026-08-14T13:43:07.834383Z","title":"Ross, George Toderici, Yeqing Li, Susanna Ricco, Rahul Sukthankar, Cordelia Schmid, and Jitendra Malik","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.834383Z"},"links":{"cited_paper":"/paper/1705.08421","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:cac1855988958cb7e5ba89daf184a96c18fb32cbb24e7d88156321fd33c3a37a","observation_id":"ff182fa5-01c6-4e99-8084-1cc7e4776dae","resolution":{"observed_at":"2026-08-14T13:43:07.834383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.01497","last_updated":"2016-01-06T06:30:17Z","snapshot_observed_at":"2026-08-19T20:39:58.906225Z","submitted_at":"2015-06-04T07:58:34Z","title":"Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.01497","snapshot_observed_at":"2026-08-14T13:43:07.844239Z","title":"Girshick, and Jian Sun","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.844239Z"},"links":{"cited_paper":"/paper/1506.01497","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:e18dd6c6ef5b39e6c2c6c50e93c12cf6582f6fb1cf8cac0638ca9b83d4f6b5de","observation_id":"db1ee7c8-e62a-4b22-8f20-94a6db5e4f18","resolution":{"observed_at":"2026-08-14T13:43:07.844239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-08-17T00:09:26.216715Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-14T13:43:07.854201Z","title":"Girshick, Kaiming He, and Piotr Dollár","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.854201Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:efdf402e555d228616bc3ff1169fa72628bb5567215bb89877a612c18bccb178","observation_id":"6294e467-cb16-436a-95d1-2e567eae337a","resolution":{"observed_at":"2026-08-14T13:43:07.854201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.00686","last_updated":"2018-06-29T07:49:08Z","snapshot_observed_at":"2026-08-19T08:48:48.124337Z","submitted_at":"2018-06-29T07:49:08Z","title":"YH Technologies at ActivityNet Challenge 2018","version":1},"cited_work":{"arxiv_id":"1807.00686","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.00686","snapshot_observed_at":"2026-08-14T13:43:08.179355Z","title":"YH Technologies at ActivityNet Challenge 2018","venue":"cs.CV","work_id":"7c409bac-8de5-4dc4-a5cf-ebde16d53085","year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.861043Z"},"links":{"cited_paper":"/paper/1807.00686","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:0e8b81c40f59d730bd0733514f2840746e9263b0f6db0b68adff11dcc645f6bd","observation_id":"68698728-99e5-47d6-8e75-82933537359b","resolution":{"observed_at":"2026-08-14T13:43:08.188871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.10066","last_updated":"2018-07-26T11:11:25Z","snapshot_observed_at":"2026-08-14T18:47:31.203366Z","submitted_at":"2018-07-26T11:11:25Z","title":"A Better Baseline for AVA","version":1},"cited_work":{"arxiv_id":"1807.10066","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.10066","snapshot_observed_at":"2026-08-14T13:43:08.106326Z","title":"A Better Baseline for AVA","venue":"cs.CV","work_id":"c8aac7d3-b396-4321-a41e-12c1d35c57bf","year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.874964Z"},"links":{"cited_paper":"/paper/1807.10066","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:9644bba7c89799c6b34287c43f1e51c25d07514f756c60789aa97b4b5f4e4cb0","observation_id":"810a9b00-183f-4ea3-ab7e-8de70dc12796","resolution":{"observed_at":"2026-08-14T13:43:08.121767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-08-21T02:14:04.953864Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-14T13:43:07.887959Z","title":"Belongie, Lubomir D","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.887959Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:88477b4d5e0beed8c593d0e9a9e784069b645d5206b803082fe4cbc1bc777ede","observation_id":"b8874b59-9822-4f13-a99c-4651d5a98701","resolution":{"observed_at":"2026-08-14T13:43:07.887959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.00137","last_updated":"2018-02-04T04:27:56Z","snapshot_observed_at":"2026-08-14T21:27:40.772250Z","submitted_at":"2016-12-01T04:36:52Z","title":"RMPE: Regional Multi-person Pose Estimation","version":5},"cited_work":{"arxiv_id":"1612.00137","doi":null,"metadata_source":"pith","pith_arxiv_id":"1612.00137","snapshot_observed_at":"2026-08-14T13:43:07.986714Z","title":"RMPE: Regional Multi-person Pose Estimation","venue":"cs.CV","work_id":"0c508d0f-1cd1-4c34-817b-0a9b856756da","year":2016},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.905464Z"},"links":{"cited_paper":"/paper/1612.00137","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:fd17cbf46bc9552765b05c33af60dde45e3206d2be15d4b7346b8b66433d5e81","observation_id":"260620be-d5ab-4be0-bc17-0e53b41fb72d","resolution":{"observed_at":"2026-08-14T13:43:07.997269Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T08:09:56.000099Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":4,"verified_fuzzy":2},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:1908.04519."}