{"as_of":"2026-08-20T23:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b50c2925796e0db03d56dc74563cd39f09d335f85feae53291993ef4e4062e50","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:01:57.130532Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12062/citation-record","integrity":"/paper/2507.12062/integrity","json":"/paper/2507.12062/citation-record.json","paper":"/paper/2507.12062"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:05.683402Z","title":null,"venue":null,"work_id":"3104f421-e27f-4114-8442-17063bd20be5","year":2017},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:50.869181Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:a0053657962b9459bf38be8683f0e99665b63b4c32228fe7c45e3ad6a5947e75","observation_id":"da313600-2ef0-41ac-8b33-b19edd209f0e","resolution":{"observed_at":"2026-08-06T17:02:05.774182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:05.536668Z","title":null,"venue":null,"work_id":"a88507fe-42c9-4d25-ab31-d736dd58d078","year":2021},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:50.944419Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:937d05c74fd528f74ba7a44ef3431427d7bdd6bf5508ecad03595ad4b8d9ec8e","observation_id":"65e1d945-a877-4924-b187-f92000682af9","resolution":{"observed_at":"2026-08-06T17:02:05.610724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:05.436433Z","title":null,"venue":null,"work_id":"603e564a-0df5-4199-b2a5-64c859eb74dd","year":2022},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.013714Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:e6970c37cae7370c9b6150169a54a03514c209d2bcbe88a240b2ca76548113f0","observation_id":"10e51e21-8079-42e1-a0f1-c70cd65386a1","resolution":{"observed_at":"2026-08-06T17:02:05.476262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:05.414585Z","title":null,"venue":null,"work_id":"4ed2f025-6fb8-4750-ac35-e15330ad7a90","year":2018},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.100813Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:aeefa603b4b6a8ee5241df0a73b394c3d103963b3c4bc2809270488b7ba315ac","observation_id":"a3388920-51db-463f-b6b8-7494ffc4bb35","resolution":{"observed_at":"2026-08-06T17:02:05.431098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:51.223100Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.223100Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:b85827600de4b1173254a846d2fc459da6a5c13d0f75f71454c687b4b8d3603f","observation_id":"677e940f-1bc0-4e77-bead-21d2308944ec","resolution":{"observed_at":"2026-08-06T17:01:51.223100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:05.217847Z","title":null,"venue":null,"work_id":"341767e1-54e6-418b-9b9c-8273e5e4de9e","year":2018},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.303288Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:5298e5b31686a8e8335f08cc106c252f97b40b0d80d3a4cdfe5e01bc7225e3d2","observation_id":"e394a4a6-fed5-461a-ae45-e3429aef85fd","resolution":{"observed_at":"2026-08-06T17:02:05.372676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:04.984729Z","title":null,"venue":null,"work_id":"951a9ed9-5ea7-40f6-a9f9-7eccea42a1bf","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.366490Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:5258f65c821c91a910e53cb0b55560ace09607a6404075d33a3da337120ca478","observation_id":"03c2f0be-e19e-4796-a27a-2b02c0023c55","resolution":{"observed_at":"2026-08-06T17:02:05.064520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:04.936342Z","title":null,"venue":null,"work_id":"ac5dd6f1-c550-4f8f-b264-54f78be0128b","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.448402Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:603dd3bf29bda6bd424260d6b222d933f62f6e89cb2b2ab791859f395c531f54","observation_id":"aa14b0af-143e-4365-800e-6484ab06eb1f","resolution":{"observed_at":"2026-08-06T17:02:04.977932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:04.777304Z","title":null,"venue":null,"work_id":"8c19d60d-e2b0-4d03-b28e-9759454b84d4","year":2017},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.518970Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:da455a0b12efd93c6ed3192a42c41292e5ceb53d38174af63223680d734dd263","observation_id":"f72a1ff8-bbe0-4717-a50c-35d8cc8425af","resolution":{"observed_at":"2026-08-06T17:02:04.859613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:04.654959Z","title":null,"venue":null,"work_id":"67d99702-50f3-4280-bb82-58fa3aa7dabd","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.635137Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:c3195c7eeccfc70b434c8c8db6bba5760e11503dc75e705af1b1b5f292bc7c1c","observation_id":"d9f78afa-171b-4f85-a9aa-9bd6e7c52e77","resolution":{"observed_at":"2026-08-06T17:02:04.721000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02755","last_updated":"2019-04-04T19:17:04Z","snapshot_observed_at":"2026-08-18T21:56:11.073893Z","submitted_at":"2019-04-04T19:17:04Z","title":"ExCL: Extractive Clip Localization Using Natural Language Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02755","snapshot_observed_at":"2026-08-06T17:01:51.695147Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.695147Z"},"links":{"cited_paper":"/paper/1904.02755","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:073421eaee0b9209bf3efb4e37bb1c05938a8db374cb2968d8a988f01bb09d12","observation_id":"9f8a1607-bcaa-4ec2-ac45-d6d6da2b1352","resolution":{"observed_at":"2026-08-06T17:01:51.695147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:04.533267Z","title":null,"venue":null,"work_id":"6973d2a3-24fb-4110-8f86-1f035f732473","year":2016},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.774969Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:ccec33a4e775d2e885878c20548506d0c27850a107a4aef1a7b070237d48e9b4","observation_id":"a0de938f-155a-4030-879e-06ee0875039f","resolution":{"observed_at":"2026-08-06T17:02:04.606939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:04.332186Z","title":null,"venue":null,"work_id":"5e2f73ac-0f00-4296-8adc-f49a1fb88f5e","year":2020},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.837535Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:cbd4f24af27add5a9a4fca91b173873c5fc855e41da1cdcac755ce7543c89798","observation_id":"6fbdaf9b-e484-4705-8e38-15e95ceed8ee","resolution":{"observed_at":"2026-08-06T17:02:04.432329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:51.937560Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.937560Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:fe5d423606c5d401283755a5337f3ceb0a9f5250facdcf461ac4c4b3359acce6","observation_id":"fa0f8091-b8ef-4e41-9bff-806d90808a47","resolution":{"observed_at":"2026-08-06T17:01:51.937560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:52.074744Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.074744Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:e35a3fed3a24d518398928e58dccbfa16e3ed5a7a4511f42f9839251dbee34e9","observation_id":"4f00260e-b41b-4320-84fe-b9a7bc717daf","resolution":{"observed_at":"2026-08-06T17:01:52.074744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:03.921499Z","title":null,"venue":null,"work_id":"8be09389-7c05-4e26-b8f7-f70a6181e761","year":2013},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.139783Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:b9d3785593b61dc1744048ed613cf8414e06c70fefb7511bc948da66f03131fe","observation_id":"14965539-9948-44aa-85f4-3b503cefbf32","resolution":{"observed_at":"2026-08-06T17:02:04.005107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:03.676752Z","title":null,"venue":null,"work_id":"f1789b22-ec58-4f75-aaa8-7bd1abff8e61","year":2017},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.198426Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:3bb3d5eeafe34867c6e41a135fb88f423393d2f31a6ae5844a8587b893d21d88","observation_id":"195346d5-6cb4-4e3b-b484-505667a2e5bf","resolution":{"observed_at":"2026-08-06T17:02:03.795675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:03.441470Z","title":null,"venue":null,"work_id":"61fd308f-36eb-4951-9414-9fb2aef7d124","year":2021},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.262998Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:62782c105101227be337bccfe68f9bebdb25bd11710200c8455504d895bf67f2","observation_id":"1f407d39-6f66-4b22-883e-778238d08b6d","resolution":{"observed_at":"2026-08-06T17:02:03.552113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:03.212963Z","title":null,"venue":null,"work_id":"795a1b2a-a4a6-4b54-9f81-68315d69ce1f","year":2020},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.329801Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:57510427db088736c14f17abd3f877922b56e212c3e0f837cf5c45a3d62b37a0","observation_id":"236f61a4-d600-4788-9607-b0b703b9900a","resolution":{"observed_at":"2026-08-06T17:02:03.315402Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:52.392417Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.392417Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:4b4da6c68d0d6bd363ccc73d169e345197c442c23c813d125eb708cba2e01a9b","observation_id":"42bf14ee-400f-4db3-ae4d-a71024a2ded3","resolution":{"observed_at":"2026-08-06T17:01:52.392417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09093","last_updated":"2025-02-13T09:04:28Z","snapshot_observed_at":"2026-08-16T12:52:38.093535Z","submitted_at":"2025-02-13T09:04:28Z","title":"From Visuals to Vocabulary: Establishing Equivalence Between Image and Text Token Through Autoregressive Pre-training in MLLMs","version":1},"cited_work":{"arxiv_id":"2502.09093","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.09093","snapshot_observed_at":"2026-08-06T17:01:57.806315Z","title":"From Visuals to Vocabulary: Establishing Equivalence Between Image and Text Token Through Autoregressive Pre-training in MLLMs","venue":"cs.CV","work_id":"95d71121-97a0-4093-ad0f-5c4f5fa14313","year":2025},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.483519Z"},"links":{"cited_paper":"/paper/2502.09093","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:6643160727fbc6778ee97a7e5f3786268bcd9df0904630179cea62e8bb4a55fa","observation_id":"555e1e01-2bda-4b0d-a871-6c919cc3702e","resolution":{"observed_at":"2026-08-06T17:01:57.864030Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10917","last_updated":"2025-05-19T09:40:28Z","snapshot_observed_at":"2026-08-18T03:58:27.298148Z","submitted_at":"2025-05-16T06:43:02Z","title":"VISTA: Enhancing Vision-Text Alignment in MLLMs via Cross-Modal Mutual Information Maximization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10917","snapshot_observed_at":"2026-08-06T17:01:52.569023Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.569023Z"},"links":{"cited_paper":"/paper/2505.10917","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:efd7c7c88b5a2fa0f49dbbae244ab083fac4a8b338c607d07486aa26bfb23c49","observation_id":"67c046c7-93fe-4e25-8faf-bfd9bf4d1412","resolution":{"observed_at":"2026-08-06T17:01:52.569023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:02.861893Z","title":null,"venue":null,"work_id":"0673dc1b-37a4-4a20-8283-1e07440ffbd4","year":2023},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.656033Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:0d924ff409902dc42ebfb94e092c4703197f38449b1dcd9792715fb41bdca2f8","observation_id":"0646cd53-ba31-4c3c-80c3-cb4cceeb6509","resolution":{"observed_at":"2026-08-06T17:02:03.049275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:52.738436Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.738436Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:83171e07bd14996bbf981fc501722581858426700374887794985ac76dfdcb29","observation_id":"2e6c1423-023e-4de5-aa2a-1ab7bf948fa6","resolution":{"observed_at":"2026-08-06T17:01:52.738436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:02.583689Z","title":null,"venue":null,"work_id":"11b2e19a-894f-42b3-89b1-7e557fa145c0","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.811438Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:ebcf301d5092980895e515d0933e3d08671909c50435c0a301f9873470f4cbbe","observation_id":"5691b0ec-177e-4aac-95db-5895a03b1a86","resolution":{"observed_at":"2026-08-06T17:02:02.649380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:02.435245Z","title":null,"venue":null,"work_id":"60d4e417-50dc-4256-812b-ef4f97128dbe","year":2015},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.037367Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:350c2b20e59ee245d5337508522bc7fcef100095bc23f58bf75f53f01ab2766e","observation_id":"daad133a-1586-4098-8483-abc4171076b0","resolution":{"observed_at":"2026-08-06T17:02:02.489906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:02.311967Z","title":null,"venue":null,"work_id":"56d55acf-0199-439a-9113-85abc34895ea","year":2022},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.135214Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:e96c75c34731a926001eefa556d03bd4994e1c9d1ae787ec885bf9fb62683180","observation_id":"c13ef623-c21f-4660-8f1c-23b9544f6441","resolution":{"observed_at":"2026-08-06T17:02:02.366215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:02.192879Z","title":null,"venue":null,"work_id":"7e56899b-0625-45e9-bdac-1fb0f93611cc","year":2024},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.196601Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:43fe6cdf7d869531a94a986efbcf8d7f3312b420594532b5491a76dcfe250a62","observation_id":"2ea3e324-d1c5-40f2-8e68-00b17135fc86","resolution":{"observed_at":"2026-08-06T17:02:02.254022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20211","last_updated":"2025-04-12T13:16:19Z","snapshot_observed_at":"2026-08-16T12:59:51.691513Z","submitted_at":"2024-12-28T16:48:55Z","title":"Generative Regression Based Watch Time Prediction for Short-Video Recommendation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20211","snapshot_observed_at":"2026-08-06T17:01:53.304316Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.304316Z"},"links":{"cited_paper":"/paper/2412.20211","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:c3a76eae2f667f87bc14e435eeba0f3c0ea53a8642e6156c2a46cdc338ff1558","observation_id":"029ab9d7-e3c4-4422-b445-a63523ee4503","resolution":{"observed_at":"2026-08-06T17:01:53.304316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:02.055039Z","title":null,"venue":null,"work_id":"966d54d8-7f56-4339-8334-6e770f3030c1","year":2023},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.367490Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:35bfff894f912102baba729f5cc42f287ab56a1dea15abcd4409b275d0e131de","observation_id":"c4b61102-18fd-4ce2-9da2-55ae43382a91","resolution":{"observed_at":"2026-08-06T17:02:02.141660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:01.935111Z","title":null,"venue":null,"work_id":"215246be-6df1-4153-a206-7e204fa7026e","year":2017},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.452553Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:01e771f1933b093429e8274cc3595e4dd120f3b4913b053aa2fb36ad4438bd13","observation_id":"b88387db-c596-4279-8d02-dbf51f5df13c","resolution":{"observed_at":"2026-08-06T17:02:01.998097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:01.805179Z","title":null,"venue":null,"work_id":"9c9351a3-81bf-4ac1-9386-e6dccfc7cda4","year":2025},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.527613Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:e07ef5126fcb22f0e8de7e2118be7a8be3e4ac4c3c0868e9062cb695dbb81c49","observation_id":"1893d2cf-85c0-42e9-8d58-dd0b71bd7902","resolution":{"observed_at":"2026-08-06T17:02:01.866689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08835","last_updated":"2024-07-03T18:05:02Z","snapshot_observed_at":"2026-08-19T10:36:23.209538Z","submitted_at":"2023-11-15T10:22:35Z","title":"Correlation-Guided Query-Dependency Calibration for Video Temporal Grounding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08835","snapshot_observed_at":"2026-08-06T17:01:53.655769Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.655769Z"},"links":{"cited_paper":"/paper/2311.08835","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:656ab71dbe89fec0395a19e008e06b6964c69b7f9676b9b097c5f151dd77534b","observation_id":"8b8ace74-75e2-41a7-a16c-22585e20c023","resolution":{"observed_at":"2026-08-06T17:01:53.655769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:53.716882Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.716882Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:fb7f89618bb6ae5a3fff83a7e443dcd7a3ea0c5ea13c3c081ef86777f4a2fe92","observation_id":"040bec3c-1c6e-4dee-82ce-fddc99118a55","resolution":{"observed_at":"2026-08-06T17:01:53.716882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:01.520128Z","title":null,"venue":null,"work_id":"8e166127-d000-4145-8f65-cf0e969adf04","year":2020},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.933142Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:26a000a2430655cba25d4e6fbda94f3cd81245a0dbd0d10eeb2482179214e549","observation_id":"a2705a62-48c7-4d5e-966b-8297025c396e","resolution":{"observed_at":"2026-08-06T17:02:01.605403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:01.373261Z","title":null,"venue":null,"work_id":"08e7b251-a022-4383-a115-59c8e0dbbb40","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.046348Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:cdf565e9c6bd4acc875126db62f1a84b402757b792c716153694ca925cbd0b6c","observation_id":"5c013700-15a0-4b79-9ecf-31131a0778e1","resolution":{"observed_at":"2026-08-06T17:02:01.443661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:01.676618Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"f0f91690-b5a8-4894-b9d7-ba4cec77c77e","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:53.810467Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:dce16a1676e8fc3c16bcd489a42b4454abb1bbaa91078e8f80913c088964e625","observation_id":"faaaf3d0-28df-4538-902b-c89eb4f020ef","resolution":{"observed_at":"2026-08-06T17:02:01.736228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:54.360770Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.360770Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:d20b986558f4f2bb7146e51ccfa783a29c1f75359d1541e2e279980ed2ed6836","observation_id":"d55b6c16-4552-4065-87c5-960399a9aee7","resolution":{"observed_at":"2026-08-06T17:01:54.360770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:54.487261Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.487261Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:73c97d3332cce0b3444b5acd8e9ace4877c3d4e1bb8fe6ae930f747741583bc9","observation_id":"a6494f00-0a59-4996-8e96-b3ceea5632d8","resolution":{"observed_at":"2026-08-06T17:01:54.487261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:01.023845Z","title":null,"venue":null,"work_id":"41997150-7ca1-44f6-afb9-a08fd6c09792","year":2018},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.579323Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:ac931b067685f5aa48f0199aa9ac75f7e9827dd293d381d2a20179eb91e263cf","observation_id":"67b87124-c407-4299-9b9e-3f62f9a0db50","resolution":{"observed_at":"2026-08-06T17:02:01.114759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:54.261850Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.261850Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:5904514b0c4840fa1373a1b1ec651a83d1c6b5d2017b008baa8fca1e5ac504b9","observation_id":"8bb59438-c28b-4f13-8a24-ea6c90092855","resolution":{"observed_at":"2026-08-06T17:01:54.261850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:54.747581Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.747581Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:449932d96986a2152723d5786fa33cea5b69b8687d57d1865959625c225d7bfd","observation_id":"21ddc416-f038-44eb-b236-555c1d03d87d","resolution":{"observed_at":"2026-08-06T17:01:54.747581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02309","last_updated":"2024-01-05T03:11:28Z","snapshot_observed_at":"2026-08-16T14:29:49.586127Z","submitted_at":"2024-01-04T14:55:57Z","title":"TR-DETR: Task-Reciprocal Transformer for Joint Moment Retrieval and Highlight Detection","version":2},"cited_work":{"arxiv_id":"2401.02309","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02309","snapshot_observed_at":"2026-08-06T17:01:57.616303Z","title":"TR-DETR: Task-Reciprocal Transformer for Joint Moment Retrieval and Highlight Detection","venue":"cs.CV","work_id":"52764126-79b4-4ffd-aa69-8d4986fe3e66","year":2024},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.823917Z"},"links":{"cited_paper":"/paper/2401.02309","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:0c84a71ae6117bcbbb518392ee0e384e2b23e0910541d3ddb3719ff4c789e075","observation_id":"b04b19d0-c9b5-4335-b6bd-4056d51c8ffd","resolution":{"observed_at":"2026-08-06T17:01:57.695065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:54.970339Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.970339Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:ef30a65191983409e70ab482d4922ee7caf4c6fc38ed9896b10212f25b7954c8","observation_id":"56d80672-1d52-4f58-94d5-f6ea0fbcd407","resolution":{"observed_at":"2026-08-06T17:01:54.970339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:00.841667Z","title":null,"venue":null,"work_id":"83851f68-cbfa-468d-83d0-95b42476fad6","year":2016},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.649962Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:eb605777f43e1a239f942e57a03f021f161fdfc7cce1c2eae36440b53feff436","observation_id":"12181e44-80fb-40c7-b950-87f686f68b33","resolution":{"observed_at":"2026-08-06T17:02:00.924570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:00.676171Z","title":null,"venue":null,"work_id":"a7d451de-f546-47ea-b993-f2693e8d8c1c","year":2020},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.144345Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:a6c24851562c1acb574deeaef6e3df919c3dc3beb81ddb2c313d916fc965edbd","observation_id":"395e2ad1-08de-413e-ba2d-5437cd3c9014","resolution":{"observed_at":"2026-08-06T17:02:00.740711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16464","last_updated":"2023-11-28T03:55:23Z","snapshot_observed_at":"2026-08-17T22:31:14.262146Z","submitted_at":"2023-11-28T03:55:23Z","title":"Bridging the Gap: A Unified Video Comprehension Framework for Moment Retrieval and Highlight Detection","version":1},"cited_work":{"arxiv_id":"2311.16464","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16464","snapshot_observed_at":"2026-08-06T17:01:57.435566Z","title":"Bridging the Gap: A Unified Video Comprehension Framework for Moment Retrieval and Highlight Detection","venue":"cs.CV","work_id":"42a6520e-bcbd-4ca6-b9a3-c4a3161050d2","year":2023},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.234016Z"},"links":{"cited_paper":"/paper/2311.16464","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:dac5eaa7db4c97165379b1f8a5f5aa96502be1a220fea574546f999fc838b891","observation_id":"7e951564-d320-4930-8534-27fe5ecc8808","resolution":{"observed_at":"2026-08-06T17:01:57.514774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:00.540388Z","title":null,"venue":null,"work_id":"49e141c8-1c78-4ca2-9ea1-eb3c1e901af0","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.335596Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:f8e218b1ffde87686f1e42c8a59e9cd16ea981f04d9ea6569a70df365e28650c","observation_id":"b21943ca-7b81-451c-bc21-406c303084bf","resolution":{"observed_at":"2026-08-06T17:02:00.601394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T17:01:55.067828Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.067828Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:3c984c9180f9dfd3b199fc77d96298ff6543d104b5332fcf840e0225e35f3f4c","observation_id":"713a9ea1-d22d-4f57-97b7-3080719f6204","resolution":{"observed_at":"2026-08-06T17:01:55.067828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:00.186582Z","title":null,"venue":null,"work_id":"f58855d3-38b8-4647-9c86-a3b99b5ce45a","year":2021},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.547814Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:28d71af09a36946054cd32b7adbd519819874178f33c9950010033bc4439b829","observation_id":"959f5f75-d4a5-4056-8e02-4f14bb7c40ab","resolution":{"observed_at":"2026-08-06T17:02:00.305060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00355","last_updated":"2023-04-29T22:50:53Z","snapshot_observed_at":"2026-08-17T13:47:36.045758Z","submitted_at":"2023-04-29T22:50:53Z","title":"MH-DETR: Video Moment and Highlight Detection with Cross-modal Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00355","snapshot_observed_at":"2026-08-06T17:01:55.650417Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.650417Z"},"links":{"cited_paper":"/paper/2305.00355","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:7dd0cf6329c143120f1e5c1bd46ab7a02340d98fc9bab0c7c7ffdaef19a697d1","observation_id":"25426ab9-f69d-4e44-8218-ae05f51e583c","resolution":{"observed_at":"2026-08-06T17:01:55.650417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:00.027265Z","title":null,"venue":null,"work_id":"0a1b97d6-83dc-490e-8e18-195139268a4f","year":2024},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.734128Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:793da0e6c2fc9c2605b8d50f4a171dae2434c12117a7b46639b21881666498e1","observation_id":"825cb218-d257-48ca-b4bd-57b483e64252","resolution":{"observed_at":"2026-08-06T17:02:00.090591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:00.374752Z","title":null,"venue":null,"work_id":"c4ea5b17-e77a-4899-b318-15110b6a09c3","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.457230Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:0c8b0475de0117d706262364db5d7cb55c2585f23634bea0f3e7b639235ef3ae","observation_id":"49dc8596-fc4d-4050-87a5-1811af1740b8","resolution":{"observed_at":"2026-08-06T17:02:00.462034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:59.688624Z","title":null,"venue":null,"work_id":"c0456def-5e92-4103-bb85-40b8af13475d","year":2023},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.955226Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:be8b88c5f4f9fb4c48bc264eec9fac065fdbc9a0108ba53c2e84edac00d90fdd","observation_id":"a1629ad6-a20a-45b2-aa1d-3f594c63e35a","resolution":{"observed_at":"2026-08-06T17:01:59.759065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:59.471573Z","title":null,"venue":null,"work_id":"fe814a43-4f0f-4ef8-938b-feccd37c08ac","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.029153Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:7ee9e4363eb116d3b5f07d15d08c72d235d1951ac75ee6ed39c83ba7f83a9a2a","observation_id":"de3f84a6-c853-4a04-a60f-4ef57f228d3a","resolution":{"observed_at":"2026-08-06T17:01:59.588126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:59.022211Z","title":null,"venue":null,"work_id":"4968c0eb-40b7-482d-a49e-9f2105c2d8f0","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.215102Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:ddbc2cad8fc23d7235bfba8987b04e517ac5749b39096d84cac4b1967d9df369","observation_id":"6908063b-2c45-4560-8c5e-c6c8524dc170","resolution":{"observed_at":"2026-08-06T17:01:59.142221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:59.837855Z","title":null,"venue":null,"work_id":"9d6dd2f0-86b2-4f3e-8d4b-d344e2f2959e","year":2025},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:55.827167Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:896ca81c4921185fd65895949fe8ce82810d6076fac02179a782a1f6b5a4e48c","observation_id":"f98da8eb-c6f1-4862-958e-4d7b0f9dd769","resolution":{"observed_at":"2026-08-06T17:01:59.914368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11435","last_updated":"2024-12-16T04:23:33Z","snapshot_observed_at":"2026-08-17T18:13:19.351232Z","submitted_at":"2024-12-16T04:23:33Z","title":"Learning Implicit Features with Flow Infused Attention for Realistic Virtual Try-On","version":1},"cited_work":{"arxiv_id":"2412.11435","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11435","snapshot_observed_at":"2026-08-06T17:01:57.253188Z","title":"Learning Implicit Features with Flow Infused Attention for Realistic Virtual Try-On","venue":"cs.CV","work_id":"bece7d31-abdb-4127-b7b7-d71cb26fa0be","year":2024},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.448712Z"},"links":{"cited_paper":"/paper/2412.11435","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:3a0ac3316004168d47dba787b6aed300bee0be2fd3c5d6dc55891834901f6bfd","observation_id":"057d5f86-c1a8-46e1-8c78-10533682f541","resolution":{"observed_at":"2026-08-06T17:01:57.336574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:58.793499Z","title":null,"venue":null,"work_id":"f2edd845-4864-459b-9d66-f7437b94eb3c","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.544979Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:a3bdd2dd3e14dde1e237f770b05e8f383f2665d7d08209eb9217f2027d4651f5","observation_id":"cc219044-afe2-4760-b5f7-7b6ee7eed4d1","resolution":{"observed_at":"2026-08-06T17:01:58.832197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:58.481314Z","title":null,"venue":null,"work_id":"f9b52c4c-8ef0-45ea-aeb0-496f90954795","year":2021},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.725402Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:769e20a241317f545771edee575665e4fd343de25de817f7c91326d077c7190c","observation_id":"a2de970c-fb7e-47b3-84dd-22fe011d11d2","resolution":{"observed_at":"2026-08-06T17:01:58.574328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.13931","last_updated":"2020-06-14T08:49:07Z","snapshot_observed_at":"2026-08-20T04:16:24.606421Z","submitted_at":"2020-04-29T02:47:04Z","title":"Span-based Localizing Network for Natural Language Video Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.13931","snapshot_observed_at":"2026-08-06T17:01:56.789076Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.789076Z"},"links":{"cited_paper":"/paper/2004.13931","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:5df66f2ad9f36cc4d0c76dae530f760bf0e7507345e320bc63b1b6707eb1f657","observation_id":"69d7761d-49f7-4f9d-bb83-9b7e0e341bfc","resolution":{"observed_at":"2026-08-06T17:01:56.789076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:58.882500Z","title":null,"venue":null,"work_id":"af9917f3-d716-4236-8caf-0a2b93e36f5f","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.337562Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:2bfc64107aa33b415f60987acf94026737659ff573b07ecbfe42f512c68806bf","observation_id":"077690d4-62ed-4363-9627-aed7707f12e5","resolution":{"observed_at":"2026-08-06T17:01:58.942695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:58.127750Z","title":null,"venue":null,"work_id":"2277e8d6-631e-43a8-b411-ad37772895f5","year":2020},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.949824Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:8f10dfae14374147affee3da3235c494f9f5379ed7646879c6da9fa23357ffd3","observation_id":"3f9de4f3-abc1-4339-bc15-30a79d98c235","resolution":{"observed_at":"2026-08-06T17:01:58.212372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10122","last_updated":"2025-03-26T10:48:17Z","snapshot_observed_at":"2026-08-20T18:14:04.104156Z","submitted_at":"2024-10-14T03:22:26Z","title":"MuseTalk: Real-Time High-Fidelity Video Dubbing via Spatio-Temporal Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10122","snapshot_observed_at":"2026-08-06T17:01:57.033054Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:57.033054Z"},"links":{"cited_paper":"/paper/2410.10122","citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:96f73b4df4e325866f97469500c973cf8ef2493f534d04303c919486af09d158","observation_id":"74d21d0f-12d3-4872-b90f-f88063bff5ab","resolution":{"observed_at":"2026-08-06T17:01:57.033054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:57.943765Z","title":null,"venue":null,"work_id":"b7bef1ef-70fc-462c-a2c4-901ee877fa62","year":2019},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:57.130532Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:69898821d21fc7c47a2d2c431e0a701fa628bf0ef37b8d743a28d01c165e0386","observation_id":"54a56479-c594-43a3-8c55-217669de9ec1","resolution":{"observed_at":"2026-08-06T17:01:58.054991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:58.328143Z","title":null,"venue":null,"work_id":"c51b0698-2df1-471d-957d-7a4b779dac9b","year":2016},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.912837Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:2df1bc9ca147d9c040aaf8abdae5071e460b14340c39f7c249248f0cbd53a4b6","observation_id":"5b26b043-84b1-490a-a69d-38fa35ca135f","resolution":{"observed_at":"2026-08-06T17:01:58.394459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:01.198449Z","title":"In Proceedings of the IEEE international conference on computer vision","venue":null,"work_id":"0db6e858-42a3-4328-ac44-45907a5543a0","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:54.162118Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:d423424a50df823d4c7bf85df2759545a29f6ef0741b9a971ab5efa031b3963a","observation_id":"ac6507d6-ad43-4925-82bd-a6040d969dcf","resolution":{"observed_at":"2026-08-06T17:02:01.273336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:02.572338Z","title":"In Proceedings of the 26th ACM international conference on Multimedia","venue":null,"work_id":"ec48cbd7-6637-4421-94d5-dd444680a00b","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:52.922977Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:f2a07fe8139e8c2bdfa06099eee0bff99fc95e462cf857987990549e80b1f8d3","observation_id":"fb217f03-f8e9-424c-873f-6f9b11de6575","resolution":{"observed_at":"2026-08-06T17:02:02.578578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:59.226558Z","title":"In Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"bd70964b-cefc-4d85-ba95-8cbe82789609","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.106557Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:045c08ac8595c2d64343aa61c2630fa3cd3455852ae04f0f051a8b8e99ef1abc","observation_id":"70807ce9-a57f-4913-8c2c-de0c3c159928","resolution":{"observed_at":"2026-08-06T17:01:59.342757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:02:04.129952Z","title":"In Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"d698c874-a75b-47e5-9287-d345b1c6f7e7","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:51.998972Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:15fcc5e2e01bfa69db36ba0d9f5f5f8d512629259710889b0cd4844afb4f88ea","observation_id":"3a8182c0-90e1-49c4-959c-ed394fa7956f","resolution":{"observed_at":"2026-08-06T17:02:04.238160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:01:58.660894Z","title":"InProceedings of the 32nd ACM International Conference on Multimedia","venue":null,"work_id":"9eec492e-310a-43ec-9ea5-49bca4cb17f0","year":null},"citing_paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:01:56.609835Z"},"links":{"citing_paper":"/paper/2507.12062"},"observation_digest":"sha256:3be4c2ede2f7d174743517c8849db5feff7fe395cbafb7b8d61666fe8ca63e52","observation_id":"7d288fa9-80d0-42c9-9a2b-9fdab5790305","resolution":{"observed_at":"2026-08-06T17:01:58.720418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12062","last_updated":"2025-07-16T09:18:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T21:34:15.122198Z","submitted_at":"2025-07-16T09:18:18Z","title":"MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":4,"verified_fuzzy":6},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2507.12062."}