{"as_of":"2026-08-18T17:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:663e7aad14fb74f00490e09cf17662577632fea588ab9fd7304f0299132bc0f4","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:47:53.840267Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:55:21.629729Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20163","snapshot_observed_at":"2026-08-03T15:55:21.629729Z","title":"Player-centric multimodal prompt generation for large lan- guage model based identity-aware basketball video captioning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.15153","last_updated":"2026-06-04T05:17:07Z","snapshot_observed_at":"2026-08-15T17:41:01.560226Z","submitted_at":"2025-12-17T07:35:03Z","title":"Explainable Action Form Assessment by Exploiting Multimodal Chain-of-Thoughts Reasoning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T15:55:21.629729Z"},"links":{"cited_paper":"/paper/2507.20163","citing_paper":"/paper/2512.15153"},"observation_digest":"sha256:f601ca10e90d4a0317d2d223c451510005526550d0e3cb4bdc4e5a78c337f347","observation_id":"950a8896-23ab-4e88-9383-3528f1d53a28","resolution":{"observed_at":"2026-08-03T15:55:21.629729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20163/citation-record","integrity":"/paper/2507.20163/integrity","json":"/paper/2507.20163/citation-record.json","paper":"/paper/2507.20163"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T13:47:48.338225Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.338225Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:a03c17930ca93c9b397d4301af11001b567f711b9f1fcc5e21355c44e9f78486","observation_id":"615c7d59-3460-4dbd-ba72-8425a78f764c","resolution":{"observed_at":"2026-08-06T13:47:48.338225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:03.156038Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with hu- man judgments","venue":null,"work_id":"b4078688-42e5-4e13-8606-ed900dcc2329","year":2005},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.387302Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:f39af64f6e022fd59fe27c9ca3a58d17d54d90c46e6323fbed2d40dd5fcc21a9","observation_id":"c2c43baf-7352-4256-a8b6-28ee0082f827","resolution":{"observed_at":"2026-08-06T13:48:03.233657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:02.991379Z","title":"Is space-time attention all you need for video understanding? In ICML, page 4, 2021","venue":null,"work_id":"930b9c77-bff4-4a5d-9804-0563af1ba83e","year":2021},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.471255Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:34d9a893ef2656e9020a9d459cc55e5a1ae928d45f33eddff68681bf4f3d6418","observation_id":"fff18909-4ae3-4d86-8f4e-47e8ba2e2ad9","resolution":{"observed_at":"2026-08-06T13:48:03.098776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:02.831905Z","title":"Activitynet: A large-scale video benchmark for human activity understanding","venue":null,"work_id":"1a403936-6d76-492d-a73b-352bd6f74c76","year":2015},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.557375Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:2fda52042959e7c989927984df39b8abe10c87c6f786624e04c4bb1523591726","observation_id":"411cb742-a6d4-41c2-babd-432823cd6856","resolution":{"observed_at":"2026-08-06T13:48:02.909167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:02.671601Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":"d14f08d4-512c-4d9e-b2ce-71c24136dda1","year":2017},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.651033Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:5b1d468d18353e71d1646dba4ff526ecd97d98a19deb1ef8aafc3689610b22f6","observation_id":"0ec81a08-6cf2-43e0-8e5d-3dadb61c85c3","resolution":{"observed_at":"2026-08-06T13:48:02.760554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:02.515326Z","title":"Collecting highly paral- lel data for paraphrase evaluation","venue":null,"work_id":"ad5de99d-3e0b-423e-8bb1-4f739e16db56","year":2011},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.689591Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:eb372fb63a14ed83021d6a3c3a8da1883f22cdee19a34b80ffea280dd3288f20","observation_id":"66722b3d-12f4-41f1-9a81-a015d7c49748","resolution":{"observed_at":"2026-08-06T13:48:02.593360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-08-15T13:36:27.756066Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-06T13:47:48.721206Z","title":"Learning phrase representations using rnn encoder- decoder for statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.721206Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:e1ac8ab80d0e63090de2c1c7b80ebcc24ae50ba6f9847a018da8683b6605a0a8","observation_id":"059320fb-9413-43d9-9774-722ab4638539","resolution":{"observed_at":"2026-08-06T13:47:48.721206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:02.358076Z","title":"Sportsmot: A large multi-object tracking dataset in multiple sports scenes","venue":null,"work_id":"e1cba28c-8dcf-48c2-a7d9-f400d4b0fc47","year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.739135Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:660a022762c92e446fb82953ded2cf7f5585bc43a419a30e680fa46d46936910","observation_id":"e749d5fc-3a1c-493e-90f6-d4cdb1a3f469","resolution":{"observed_at":"2026-08-06T13:48:02.444435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:02.206843Z","title":"A thou- sand frames in just a few words: Lingual description of videos through latent topics and sparse object stitching","venue":null,"work_id":"2d2c9da9-828e-4eba-8220-0235583c1594","year":2013},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.785487Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:d91c1c3f4a2aa6adae995780639d885938c32a4d549bb56caaca24cfabc79100","observation_id":"3ddf3f16-8a17-4b3c-9d57-bac93c3d0a91","resolution":{"observed_at":"2026-08-06T13:48:02.255384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T13:47:48.831059Z","title":"An image is worth 16x16 words: Transformers for im- age recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.831059Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:744d9d1a1adb0837f8e0ee2138a9690011ae849f9e23c32cecf3657934933452","observation_id":"1ba5df05-4642-4508-a44d-c8cd9c866ffd","resolution":{"observed_at":"2026-08-06T13:47:48.831059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:02.065674Z","title":"Soccer captioning: dataset, transformer-based model, and triple-level evaluation","venue":null,"work_id":"436b9b91-2694-4bc1-9c8a-9274df863273","year":2022},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.890391Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:2bf0dd6d53bb86336fe754fe3dc52bfe330d9b0b95ff4d38d82d8eb9be1938ba","observation_id":"b0c30544-5258-410e-8fa8-503210534ff5","resolution":{"observed_at":"2026-08-06T13:48:02.121089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:01.867424Z","title":null,"venue":null,"work_id":"72edb7a8-b284-47db-be9a-73590b322a6c","year":2018},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.942982Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:8b9e9e8b0bb8e1576a6bacc6411e7b91da2a2b6b57c334fedc71f7a73e9d474e","observation_id":"28674be7-f982-4455-aefa-ff76dfeaade9","resolution":{"observed_at":"2026-08-06T13:48:01.960339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:01.701737Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"89f71c22-23bc-421d-a9cb-12ddc3fad6bc","year":2016},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:48.982219Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:114807d870268ef07ea4c6b98e3acbdf4fb147061b3c5491951df4f93300b935","observation_id":"ca1ec4e3-4f73-457f-bbb0-82bcc2a39c01","resolution":{"observed_at":"2026-08-06T13:48:01.789107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-06T13:47:49.051493Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.051493Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:e1fee6e9c70eec334039056414f2c38d99e021018bf9e94aafbcecfa8de55b87","observation_id":"f9ab540d-86f4-4e49-82d5-b22887b02b66","resolution":{"observed_at":"2026-08-06T13:47:49.051493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:01.489702Z","title":"Overview of temporal action detection based on deep learning","venue":null,"work_id":"e208e086-a721-4555-b7e5-939c5d0174d0","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.111293Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:d398ee853c54dacf765dacaa0c8bcd1127af6e209bdb5d4a472be5f2cb7ee0cf","observation_id":"830bdf3f-bf20-47c4-b106-f1922277feca","resolution":{"observed_at":"2026-08-06T13:48:01.578230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:01.293458Z","title":"Learn- ing to generate move-by-move commentary for chess games from large-scale social forum data","venue":null,"work_id":"e18cfd2d-754b-46bb-abd6-7a914c41c8c6","year":2018},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.229047Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:e8f1c7582c105d4ec51693f1c962944be1cb6fa9f83b7c92f7832ed5bfc9cb46","observation_id":"4d3642e8-9f19-4e66-afe3-f34de4e784d0","resolution":{"observed_at":"2026-08-06T13:48:01.371450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:01.082452Z","title":"Learning seg- ment similarity and alignment in large-scale content based video retrieval","venue":null,"work_id":"0cd8fc17-b15e-41ef-8f5e-7203e54835f8","year":2021},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.383887Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:f4c208e8a25cdda724346594db2dceea4cfb4daa08328ae18dc870abeb175bba","observation_id":"9b0d2555-6dd6-4586-bb63-a0dd0deded6e","resolution":{"observed_at":"2026-08-06T13:48:01.166288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:00.949246Z","title":"Automatic baseball commentary generation using deep learning","venue":null,"work_id":"500b47e1-4cbe-4320-a0a9-f94393f7364e","year":2020},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.465481Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:50174c957e8d82f5e6dbd493abdaf61ee55c32283a369550bc4504bb123d5af4","observation_id":"9163806d-f645-4003-a9b9-4116062688c1","resolution":{"observed_at":"2026-08-06T13:48:01.005079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T13:47:49.583990Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.583990Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:6256799ede79949d8c681156d192429fdc8071d09ee79e5c7b07099e57a62e27","observation_id":"8d357874-4819-4675-b8b5-8f6966fb7123","resolution":{"observed_at":"2026-08-06T13:47:49.583990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:00.783993Z","title":"Video story- telling: Textual summaries for events","venue":null,"work_id":"45f04e0f-20d9-415c-93cb-9a6d1e37e2ff","year":2020},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.829969Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:a7ee35aba8acfa3b3a1347e724552c9115064490c430d204baacba82cf0fa7a8","observation_id":"639bf675-0666-4cec-92d7-0ac52890f53c","resolution":{"observed_at":"2026-08-06T13:48:00.869574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:00.595158Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":"e46c2626-216f-46cc-aa4e-ec4b33273a68","year":2004},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:49.952635Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:276a2ba909f498285da2e1eee389ef6ec0413b1ffcfcbf88650b1a273d3c4611","observation_id":"3550829e-2298-4d99-8af8-0e6f3c1021da","resolution":{"observed_at":"2026-08-06T13:48:00.680689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:00.419932Z","title":"Swinbert: End- to-end transformers with sparse attention for video caption- ing","venue":null,"work_id":"c802fc8a-a249-4a4e-92b2-dc36fe8b2f25","year":null},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:50.083025Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:f61267b87eabb775316d8976151a4b21c75f029a1c8871d62d7bd064d35a8e01","observation_id":"717f7a0e-aa5a-4888-8221-67085a8a4267","resolution":{"observed_at":"2026-08-06T13:48:00.501771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:00.216121Z","title":"Video swin transformer","venue":null,"work_id":"299dc840-4598-4d2d-82db-86cb0663e533","year":2022},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:50.245337Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:5996caa3a978fe778dc2f54b29aad57d3ad0a5269f9056ee9cf6ea83b6ed499a","observation_id":"fd23068d-2a81-4dd3-a882-e03f26b28b21","resolution":{"observed_at":"2026-08-06T13:48:00.299165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:59.985811Z","title":"Llama 3.2 quantized models, 2024","venue":null,"work_id":"11c2be8b-f67e-4ec7-b00d-30bc99392671","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:50.372060Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:f8a5f9bd343a1ed2c681937141b08e7ee3446e84b972e417ebf38e0ed9277e50","observation_id":"bce3b90b-dbca-4d5a-91c8-665ec89a251a","resolution":{"observed_at":"2026-08-06T13:48:00.097823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:59.744553Z","title":"Soccernet- caption: Dense video captioning for soccer broadcasts com- mentaries","venue":null,"work_id":"a632d33c-c4e3-4edf-8c34-4b4b85e539cc","year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:50.522585Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:955f11bf1d2aedb45229e83d170e14b309615f76878e9f6052e3f1beda21f4fc","observation_id":"ccd780b4-4273-4abd-a016-7267ffcf0f44","resolution":{"observed_at":"2026-08-06T13:47:59.854049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:59.507445Z","title":"Search-oriented micro-video captioning","venue":null,"work_id":"16115abe-0bba-443c-ac45-5509e279c4a5","year":2022},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:50.650288Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:b2384e94c0df6a23527b1e7800279b6018b4572e4b27345802a410b3307d9b76","observation_id":"0fe48295-4fb5-4b2d-add4-c27f80b8e0b0","resolution":{"observed_at":"2026-08-06T13:47:59.618980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:59.266742Z","title":"Enhancing visual question answering through question-driven image captions as prompts","venue":null,"work_id":"069c71be-b6c6-4efc-8dcc-6b76834dae05","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:50.783054Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:58262d5c4c6de652c5e1ce6acd42eab84034261b370eb5fe12d283239cfb6d8d","observation_id":"b68e4fb3-067f-4dec-a121-f022be7d66ce","resolution":{"observed_at":"2026-08-06T13:47:59.373041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:59.031175Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"7417f5e3-1d98-40bf-a55d-60bf5c509507","year":2002},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:51.004697Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:6fbe7bab7d16cf5ebf2f2160bffb026bcfd61de7c047582f9a1482105cb98dd9","observation_id":"4a3e2810-37bb-4324-8303-65485346603d","resolution":{"observed_at":"2026-08-06T13:47:59.134945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:58.782596Z","title":"Identity- aware multi-sentence video description","venue":null,"work_id":"531ab6be-30a9-4998-be20-a04aca826f6a","year":2020},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:51.226089Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:1e4eebc65a130c049d610833dd2d67e8a03893fc05abd74bb1a20fe85e2e7116","observation_id":"b53fca66-fa12-430d-8a6e-7451aac9892a","resolution":{"observed_at":"2026-08-06T13:47:58.894291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:58.565892Z","title":"Goal: A challenging knowledge-grounded video captioning benchmark for real- time soccer commentary generation","venue":null,"work_id":"72781168-4527-4eee-905c-639af84b3696","year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:51.400669Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:bb58a064cc738fa7f8b94173b1956d975c48a07d03386b8bbca674c36c65562b","observation_id":"37534dc4-5bcd-4462-9b01-fe8af62f296d","resolution":{"observed_at":"2026-08-06T13:47:58.654739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:58.383928Z","title":"Sports video captioning via attentive motion representation and group re- lationship modeling","venue":null,"work_id":"6c794133-33d2-4a85-8c55-f82df7110fb7","year":2019},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:51.533250Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:8ff63925caf5ac985e48b3f9c18c18e55cd561f9ea1995c25894073f226cdf81","observation_id":"77af1dcb-5943-4b4e-96b4-73de32742b74","resolution":{"observed_at":"2026-08-06T13:47:58.457349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:58.186385Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"7b6a9b6e-0555-4ffa-ae0d-73087d635b66","year":2019},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:51.721508Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:15d7c0623d26f1926268a6dd002320b71b77eaba98561dcf3c1e8034f760572b","observation_id":"f7630cbe-3fa3-4c7e-b011-dcb167702c73","resolution":{"observed_at":"2026-08-06T13:47:58.256585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:58.025925Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"b513dd39-7cd2-4071-8c4a-f5c170af37c2","year":2021},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:51.901836Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:50321d12ee24ef655f51a7d9b7816c46d66d184d7037b5674b6e89b61fa1b5bd","observation_id":"5fbd5acf-adb7-4f10-9ac1-637ecc7db084","resolution":{"observed_at":"2026-08-06T13:47:58.105707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18530","last_updated":"2024-11-18T04:45:19Z","snapshot_observed_at":"2026-08-16T13:39:20.390167Z","submitted_at":"2024-06-26T17:57:25Z","title":"MatchTime: Towards Automatic Soccer Game Commentary Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18530","snapshot_observed_at":"2026-08-06T13:47:52.050904Z","title":"Matchtime: Towards automatic soccer game commentary generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.050904Z"},"links":{"cited_paper":"/paper/2406.18530","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:7be4cbe20f4c9f72b3a373a8973b0e0ace741a7a010b7dfd172810d08b154e4b","observation_id":"17fcd46c-ce79-4d66-9dc7-ee5dda44c2ee","resolution":{"observed_at":"2026-08-06T13:47:52.050904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:57.759396Z","title":"Towards universal soccer video under- standing","venue":null,"work_id":"543e5d56-d9e4-491f-97bc-806af99b6f5b","year":2025},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.195571Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:40ce1c89a1a50d737ff4046b416082a545ea7960935112ff9a09dbbcfc61acc8","observation_id":"9ed940e0-1380-4904-adcc-1aaf416794ad","resolution":{"observed_at":"2026-08-06T13:47:57.935512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:57.616492Z","title":"Grounding action descriptions in videos","venue":null,"work_id":"4598b321-9dbf-456b-9e18-2491d1b6aa82","year":2013},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.288758Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:827865077a7a7422667c859d63c8ec36e6e994e53f5eba65ac6740316dde5b65","observation_id":"c026b22e-20c4-4f7e-a4c7-94e13b78a84a","resolution":{"observed_at":"2026-08-06T13:47:57.685758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:57.355443Z","title":"Timechat: A time-sensitive multimodal large language model for long video understanding","venue":null,"work_id":"5d178f2a-a0e7-4830-b839-a55989992554","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.384320Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:af43670a6163507287447df79f3b3cec728f76bca278a69dc159d7572e00afe3","observation_id":"dd8cd761-f1a1-428d-ac77-a9f617db746e","resolution":{"observed_at":"2026-08-06T13:47:57.497245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:57.202574Z","title":"A dataset for movie description","venue":null,"work_id":"30268fad-733a-4e51-9798-1a86d6c3fad6","year":2015},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.476419Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:df95a19407c0177d9c6acf8b4b15dea589b932ed92f1d4ead4a236d948aa1c7d","observation_id":"cccc58cf-1f89-4681-9e80-55edcc540cee","resolution":{"observed_at":"2026-08-06T13:47:57.261849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:57.004817Z","title":"Accurate and fast compressed video captioning","venue":null,"work_id":"71a0871e-9910-4b3f-8643-6c5be3d93d1d","year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.570908Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:20d16614d147de62736ac961b9f0d1de38932b463fbf3488428256db436d9e71","observation_id":"b1a26b85-86e0-4762-87ba-0b6a957a1e6c","resolution":{"observed_at":"2026-08-06T13:47:57.090318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:56.859281Z","title":"An overview of the tesseract ocr engine","venue":null,"work_id":"1fc1ade8-1c77-41c3-b005-16657fed9952","year":2007},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.629207Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:72484dc48e63698b1dbb18011e2734fa983047c42bcf9f733d82c905ba6c8087","observation_id":"358d8369-dea1-4109-938e-9adea259b196","resolution":{"observed_at":"2026-08-06T13:47:56.929106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:56.711203Z","title":"Clip4caption: Clip for video caption","venue":null,"work_id":"dc3c21f2-2277-455b-8e2b-1d075546a2b5","year":2021},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.681290Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:1cbd4896d61235aa7f59e6696a901e98c844bbae768fd047a8dfd5a2a3f6274c","observation_id":"f79916d6-9ca0-4e4f-abeb-d43dac9275c1","resolution":{"observed_at":"2026-08-06T13:47:56.762986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:56.549127Z","title":"Qwen2.5: A party of foundation models, 2024","venue":null,"work_id":"f22b9c6f-b38a-4761-b795-728094767078","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.753771Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:47d5a6b8f1cd699cbe375e360d39a6872a802222189a8c9c16d28e99d1fa1a6b","observation_id":"37b257fc-62a8-4905-8fe4-d1b9b93c9c43","resolution":{"observed_at":"2026-08-06T13:47:56.634122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T13:47:52.792329Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.792329Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:d29bbf2868ae83466cc837edff7148c1c1ddc6aaa3f88234c6ebac4d0a5de3fc","observation_id":"6ce10f36-56a2-4295-816e-cb5b157b3675","resolution":{"observed_at":"2026-08-06T13:47:52.792329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:56.402309Z","title":"Atten- tion is all you need","venue":null,"work_id":"03713372-ad59-4b40-bb9d-47387d3d328e","year":2017},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.859030Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:348387f58f2b5485fe8b60473c4cdfc3ce497b68399269957ecf08dc8fc2b8f2","observation_id":"f50975b2-6527-41d1-b5bb-58210b190ba9","resolution":{"observed_at":"2026-08-06T13:47:56.470095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:56.204036Z","title":"Player tracking and identification in ice hockey.Expert systems with applications, 213:119250, 2023","venue":null,"work_id":"0c7e045b-998a-4af0-8c88-8cd9ed95a460","year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.919724Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:460392ef4c6648f945056e6a3f9ab2b37e1f86287ad7b1414cfd45d86d6cfdfd","observation_id":"1c967b64-34d4-4209-935d-c7c83bc22406","resolution":{"observed_at":"2026-08-06T13:47:56.298252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:56.011839Z","title":"Cider: Consensus-based image description evalua- tion","venue":null,"work_id":"8e1de270-6961-4936-a2ba-fbcbfdc72f5f","year":null},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:52.975748Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:8e5d5ca386fc23b9b58b0f59fee5e5ba4e25f4b89f3b54239e883c3138b5fc86","observation_id":"98ad022a-2a58-4206-80ae-5b22fdb2ef3a","resolution":{"observed_at":"2026-08-06T13:47:56.092821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:55.879535Z","title":"Omnivid: A generative framework for universal video understanding","venue":null,"work_id":"74ab2c2f-a07b-430a-ac50-0643dc3dd864","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.023439Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:4c2df6d7d113aedfd586e77ea8f6a8a7d3d907d0a2d80d59dbf5772ef950074e","observation_id":"265d17ab-2956-4a69-85f1-c0a1c0511237","resolution":{"observed_at":"2026-08-06T13:47:55.936975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:55.730408Z","title":"Sports video anal- ysis on large-scale data","venue":null,"work_id":"265577cd-b31e-4438-b04a-11f627f1d53e","year":2022},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.059771Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:7e08b4a9f23550fa0500cc6c4e5d6a32220b8002c0e7e94f1b31a8af67f3f64a","observation_id":"371e9520-823e-41f1-aa81-b12c4ac8fd27","resolution":{"observed_at":"2026-08-06T13:47:55.808364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:55.585828Z","title":"Learning label semantics for weakly supervised group activity recognition","venue":null,"work_id":"f29f5fe0-c374-48b3-b445-2b510b13443b","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.106462Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:a3afdbd0652fc4e7f3370e0f96d20076d9c0175b70a6c822dbd93f0cbe9c86f6","observation_id":"4e6ee851-9abe-4eab-8126-257f9d148816","resolution":{"observed_at":"2026-08-06T13:47:55.644024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:55.384085Z","title":"A simple yet effective knowledge guided method for entity-aware video captioning on a basketball benchmark","venue":null,"work_id":"e9847a82-13ff-4422-91a3-912687034f30","year":null},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.202516Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:c6ebcfb5775d2c33761f958d241a63088e6fba95273b2bacdd6955865a58ad71","observation_id":"d8c8a3ac-9f04-42ef-b5ff-18212b579d07","resolution":{"observed_at":"2026-08-06T13:47:55.465434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:55.242915Z","title":"Eika: Explicit & im- plicit knowledge-augmented network for entity-aware sports video captioning","venue":null,"work_id":"e7377ff5-6c60-4f8a-8a5d-34d03894193b","year":2025},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.279524Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:f8ca53dfdc3981f7f87f7be275acc26bf1f410afb29f9fb996c5d7db1a63f286","observation_id":"c9368bf4-c517-4bea-9e43-b0b69e46abe0","resolution":{"observed_at":"2026-08-06T13:47:55.304502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:55.088688Z","title":"Msr-vtt: A large video description dataset for bridging video and language","venue":null,"work_id":"93c1ffb7-fca8-49c3-ac69-ff80e3bf2609","year":2016},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.363030Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:43bb171eae9e98e4f53513933bb269db7f412819a33c4968c74ef88d6899f54b","observation_id":"93235d0d-b85a-4a05-b083-928108e89e78","resolution":{"observed_at":"2026-08-06T13:47:55.163118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:54.898061Z","title":"Hierarchical modular network for video captioning","venue":null,"work_id":"fe45b478-d4d8-467b-9ba6-937d7a702ff7","year":2022},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.424019Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:e97cdaf895830fc94f887555e7127556f48488696d22eb503525fb043cbab551","observation_id":"66f835c6-e6b0-4a1e-9771-1efe8ff04925","resolution":{"observed_at":"2026-08-06T13:47:54.964288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:54.768054Z","title":"Fine-grained video captioning for sports narrative","venue":null,"work_id":"a734ea6b-6636-4347-b2ba-44f548bf7a20","year":2018},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.530146Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:856b5a4414e837ce27da80fc2113a2b25296d0c89766b028c4a42ce8366b734b","observation_id":"4357c369-9a65-48c0-9f0f-736c24d4eb78","resolution":{"observed_at":"2026-08-06T13:47:54.829046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12140","last_updated":"2023-06-27T11:42:44Z","snapshot_observed_at":"2026-08-16T15:31:30.918699Z","submitted_at":"2023-05-20T08:43:51Z","title":"Movie101: A New Movie Understanding Benchmark","version":2},"cited_work":{"arxiv_id":"2305.12140","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12140","snapshot_observed_at":"2026-08-06T13:47:53.956828Z","title":"Movie101: A New Movie Understanding Benchmark","venue":"cs.CV","work_id":"88767c7c-55d4-4ec1-aa28-658708d085d9","year":2023},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.617274Z"},"links":{"cited_paper":"/paper/2305.12140","citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:29627655e2a79f57602e3399cd1f2db111043f746d4d78e6781b2308be78ed03","observation_id":"0fe3ff17-e83f-4ba0-9c7d-568a37f848fb","resolution":{"observed_at":"2026-08-06T13:47:54.028783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:54.643039Z","title":"Harnessing large language models for training-free video anomaly detection","venue":null,"work_id":"84bb619b-94a4-486b-b8a6-924f37c169d3","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.702448Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:355dfd583b309fe7f33b42d6382feae9e0409c83eb687222981f5b11f0c3f851","observation_id":"c7834a93-67fc-4937-83c0-de9ac951366d","resolution":{"observed_at":"2026-08-06T13:47:54.711821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:54.530922Z","title":"A descriptive basketball highlight dataset for automatic commentary gen- eration","venue":null,"work_id":"ac6c8548-9ef3-42fd-9d0f-079abbf8e3a2","year":2024},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.781975Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:aebad78cb2671be218b8c3f9130b312c350643c894e45fb3a8a181ac06206a6e","observation_id":"ac9f3192-e1d3-4827-9cf4-099253389e48","resolution":{"observed_at":"2026-08-06T13:47:54.589144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:54.353753Z","title":"jump ball","venue":null,"work_id":"21f49ee9-6f77-4c51-b25a-20a29988bee4","year":2018},"citing_paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:53.840267Z"},"links":{"citing_paper":"/paper/2507.20163"},"observation_digest":"sha256:95f473a53f9a65800aa5be7a2ce486f9fa07484734988a5530744266472f4e52","observation_id":"3d044e4e-301e-400c-90f2-2c0b96895b92","resolution":{"observed_at":"2026-08-06T13:47:54.449519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20163","last_updated":"2025-07-27T07:30:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T17:45:38.271077Z","submitted_at":"2025-07-27T07:30:56Z","title":"Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":49},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 1 inbound Pith citation observation for arXiv:2507.20163."}