{"as_of":"2026-08-22T14:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13f5af4223d3aa1537ef23e1345c65d3d58b4b0d626558e79202b59ca31f49fc","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:49:18.410885Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.12791/citation-record","integrity":"/paper/2412.12791/integrity","json":"/paper/2412.12791/citation-record.json","paper":"/paper/2412.12791"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.270605Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.270605Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:1a2d2a7ff6dcd7e920d0849f2745ecd766dd2e62ed06a84a919881db6a445f02","observation_id":"0c8fd0ee-38f8-4d38-bd97-6cf76858871c","resolution":{"observed_at":"2026-08-11T13:49:18.270605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.275152Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.275152Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:df54db5c36cffbf51ba09cf55cbb2bbc31bd2eab34980f88c748542e769b0d3c","observation_id":"45de6bea-dafb-4f83-a8e7-ee8ef0383cde","resolution":{"observed_at":"2026-08-11T13:49:18.275152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.279224Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.279224Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:34d909bb51b89b290e7f3ab6413ef40f09ba508bb8bf9bd75b84366ccc06cc8f","observation_id":"41a48afd-b79c-49b6-a3f2-c4e543305769","resolution":{"observed_at":"2026-08-11T13:49:18.279224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.800628Z","title":null,"venue":null,"work_id":"0ee710ee-f48c-4d55-b3d9-10d822e16086","year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.283386Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:324296dd3c5e3fed0a57524cf67e5843a614247dd22168a8f972115aa2a5793b","observation_id":"a1582a86-97b2-4f57-b6ea-64f59a0c3498","resolution":{"observed_at":"2026-08-11T13:49:18.804015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.789965Z","title":null,"venue":null,"work_id":"ac35c9fc-c8cd-45ac-b875-356f000a89dd","year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.287062Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:44d35b8816d38e9204fa794cc55a6eaeee8926d6a7ce46a152a27166488d1460","observation_id":"3ab1c90b-e82d-421e-b120-a990c574ec48","resolution":{"observed_at":"2026-08-11T13:49:18.793414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05092","last_updated":"2019-07-11T10:29:04Z","snapshot_observed_at":"2026-08-19T11:15:52.060964Z","submitted_at":"2019-07-11T10:29:04Z","title":"Activitynet 2019 Task 3: Exploring Contexts for Dense Captioning Events in Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05092","snapshot_observed_at":"2026-08-11T13:49:18.290728Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.290728Z"},"links":{"cited_paper":"/paper/1907.05092","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:f4d7bb4772da6567bf0658f0eb5818b782121c3e8390212c25b5905312c5c7e0","observation_id":"d1945420-2520-488f-a1bc-85cbcb2835d2","resolution":{"observed_at":"2026-08-11T13:49:18.290728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.778785Z","title":null,"venue":null,"work_id":"44976a22-fe0f-4991-a969-c5256360ec5c","year":1987},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.294473Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:aa294f20156bd02d41d093bfac3b004ee2f4003ffde1e20b7f2bcc66b6f3630d","observation_id":"70be8746-b1b3-4418-b313-6759dd7b7cc7","resolution":{"observed_at":"2026-08-11T13:49:18.782533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.768338Z","title":null,"venue":null,"work_id":"6bbb1dd1-65cf-4693-900d-470a2ef2ef8c","year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.297798Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:45950b98d660b928806159f540e97467099e830527672c05c4c6be7eb2d3dec5","observation_id":"77dfa9ac-0827-4bb5-a020-b24bdf98abb8","resolution":{"observed_at":"2026-08-11T13:49:18.771519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.758482Z","title":null,"venue":null,"work_id":"9ccd1baf-bc07-4ed4-8a88-2271d64f482b","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.301373Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:b2993c6c4b315700185056d7bc5d634cd3a827cd35ffde3e883d82016ef49801","observation_id":"63ba084b-8414-4f91-8847-42f186e44100","resolution":{"observed_at":"2026-08-11T13:49:18.761602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.304743Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.304743Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:373daf2f7d619577d6502d5326acb5b3344e4008d83ac822cf4e834c5b6fd1ec","observation_id":"96dda655-502a-44f8-8db4-a7856384542f","resolution":{"observed_at":"2026-08-11T13:49:18.304743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.741342Z","title":null,"venue":null,"work_id":"76394fdf-d585-4c75-9a86-a7d084ebd0f2","year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.307943Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:bb16f156402d4b57b06e7e47b11e205a90565254fcad8c3bc61c68d46e58c418","observation_id":"9193543e-cb6f-456e-bf4c-c962faf98920","resolution":{"observed_at":"2026-08-11T13:49:18.744623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11760","last_updated":"2020-11-10T21:49:14Z","snapshot_observed_at":"2026-08-16T19:06:45.542680Z","submitted_at":"2020-11-10T21:49:14Z","title":"Multimodal Pretraining for Dense Video Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11760","snapshot_observed_at":"2026-08-11T13:49:18.311365Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.311365Z"},"links":{"cited_paper":"/paper/2011.11760","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:47fa2810c39c8cf51f9fee85198e540c2b8715b1e29e8708538d83edeee000db","observation_id":"156cc3b9-03e2-4943-9189-226d11e51bf0","resolution":{"observed_at":"2026-08-11T13:49:18.311365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.732032Z","title":null,"venue":null,"work_id":"a3729a9b-d395-4051-b6e3-2a2d71a72c74","year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.314921Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:7dc71beee1c9c06ee913b8bd6cd2e7016a0f637df04f8666f69d5205a17ab093","observation_id":"b91c38c7-fd5d-4fbb-87c8-8709e1718b93","resolution":{"observed_at":"2026-08-11T13:49:18.734950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.721837Z","title":null,"venue":null,"work_id":"8d152607-9db3-424e-a6e0-a257fca2895b","year":2024},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.318004Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:8b48b54feea4be2c6a9b6470211a894107546d75d5fee307dc2e59f83e8af9fc","observation_id":"4aa6ddcf-bcbe-48c8-840a-5931e6e1d3b7","resolution":{"observed_at":"2026-08-11T13:49:18.725065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.321235Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.321235Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:51184b305056c01d1388cf689d84ab00589bdabeea3a733b32e4453c6a502c04","observation_id":"53d86233-f116-4ddf-bff5-81c150e528c6","resolution":{"observed_at":"2026-08-11T13:49:18.321235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-20T12:00:24.760146Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-11T13:49:18.324495Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.324495Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:f24141f8a22608e7336d286769bb448bc50bf54852655ca8b98566a8644d96e6","observation_id":"9b3e134a-feac-41fd-bd87-369fa69284d1","resolution":{"observed_at":"2026-08-11T13:49:18.324495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.705215Z","title":null,"venue":null,"work_id":"f9472397-188e-4cef-93a1-f1c196bea182","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.328275Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:f0150f85493b6f84d895ec645d19d4f5c12d7f2ffac3de94b37a575e1e96a032","observation_id":"933f64c1-e60f-42de-b9ed-335a57145202","resolution":{"observed_at":"2026-08-11T13:49:18.708755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.331804Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.331804Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:fff499609cc5d55b87b66c39e96944ef73be02263e0745445d61872c145b221c","observation_id":"89a535c8-5f42-4e5f-92e4-6faadc6cad70","resolution":{"observed_at":"2026-08-11T13:49:18.331804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.688512Z","title":null,"venue":null,"work_id":"3547f504-86f5-4bed-8241-9604fa4bc9bd","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.335057Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:8fff3f05dbb98ff0712e028cf75039845dcf8df59aca6af73a2aac599a390380","observation_id":"9a404bb1-0cf2-4edc-9367-b1ceaf929d7a","resolution":{"observed_at":"2026-08-11T13:49:18.691545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.338664Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.338664Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:88e4f4a8b857099e4101cccb229f2b3188895b0778ae401de7fcb1c1f47b2caa","observation_id":"f6411051-41d9-4a19-8f53-5409e03bd4b8","resolution":{"observed_at":"2026-08-11T13:49:18.338664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T13:49:18.341916Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.341916Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:a7f461134a8863e5e11a56fb0396dfcda0f2ba2cc2d2dc9d44087f70a748a08c","observation_id":"7b8d1ebf-56e8-4b30-9aea-115c6afee848","resolution":{"observed_at":"2026-08-11T13:49:18.341916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.671207Z","title":null,"venue":null,"work_id":"5962b5a7-0443-4ced-8d65-645019b76435","year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.345519Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:869c7e486715437c572e312620644e952094b1d3f35d4eddbde62e312cc2e319","observation_id":"815ce9a0-c24f-4134-a6a9-918da3b91665","resolution":{"observed_at":"2026-08-11T13:49:18.674495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.660868Z","title":null,"venue":null,"work_id":"8a136ffa-e9a8-4fff-a3a0-16363a79adf4","year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.348942Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:6339e0f3fb14e101253d71d68d4c625ed25ccec4470c2d40509fc684682ef6cc","observation_id":"8e4de286-47c6-47e0-8a31-e34455db19df","resolution":{"observed_at":"2026-08-11T13:49:18.664339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.352279Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.352279Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:8afb82bb0c86e86281b806790ca937b77355a6f35e9dcc36910b8abf4dd7ac5e","observation_id":"98db2c1c-ee49-45b7-a7ac-28ada89d59c4","resolution":{"observed_at":"2026-08-11T13:49:18.352279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.355613Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.355613Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:000b16604ba07ef88dacca08302b83c5c6776475aa20b7f2329bd47d47887f63","observation_id":"e35f4394-7a6f-40c9-aeed-78d81427b224","resolution":{"observed_at":"2026-08-11T13:49:18.355613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.358917Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.358917Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:637951be81a356823ce57377c07054dcb6737d6649068e9cef3aa7a46775f437","observation_id":"95ffc91c-add1-41c5-9cda-2333a521a91a","resolution":{"observed_at":"2026-08-11T13:49:18.358917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.362165Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.362165Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:49a576782e849a2663981d5270c91033e5f405c5f18de16e60637cf14bf0656d","observation_id":"b42a008c-1163-47ff-8179-c445ee5ec005","resolution":{"observed_at":"2026-08-11T13:49:18.362165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.366614Z","title":"H.; Nagrani, A.; Arnab, A.; and Schmid, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.366614Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:00514682c322d874839d3f15468aaa8f488a0af16b2f38025111037d9888d459","observation_id":"5b5ba32f-5855-4693-9126-6f7bcd11ec65","resolution":{"observed_at":"2026-08-11T13:49:18.366614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.369876Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.369876Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:2d2e4acd6cbacfb404e3b4f1d3e9d7025e5ffbf3ea91d74f61e40173e6964b23","observation_id":"554fa3ad-b4e5-41f6-a221-74754784e396","resolution":{"observed_at":"2026-08-11T13:49:18.369876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.373148Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.373148Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:981eecc4ca47aa6abdf3ed233629249a5a65b5144e408e2d11d882d4d46e29f3","observation_id":"0ac5acca-413c-46a0-99ab-a9fd833ccefe","resolution":{"observed_at":"2026-08-11T13:49:18.373148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.600774Z","title":null,"venue":null,"work_id":"583add67-40a0-40eb-b0b6-3fca8986dcc7","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.376535Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:94d852ad94fbf11a77b28f85715e127c6e2a1f4d48d2aca7c04b5d572cf75d40","observation_id":"100e97db-20fe-400b-b1d4-1dd33538d257","resolution":{"observed_at":"2026-08-11T13:49:18.604325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.589906Z","title":null,"venue":null,"work_id":"6189fa8f-bfe7-4efe-87da-4d59f568562c","year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.379859Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:47f5e5c4e5310cc9f16e48c0d1cde4e8bb3d9aab3fe142e5f515777f66f98d94","observation_id":"56fb7b97-f042-40c5-b264-c305ad46d535","resolution":{"observed_at":"2026-08-11T13:49:18.593166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08252","last_updated":"2021-05-18T03:21:37Z","snapshot_observed_at":"2026-08-16T18:24:04.492988Z","submitted_at":"2021-05-18T03:21:37Z","title":"Weakly Supervised Dense Video Captioning via Jointly Usage of Knowledge Distillation and Cross-modal Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08252","snapshot_observed_at":"2026-08-11T13:49:18.383065Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.383065Z"},"links":{"cited_paper":"/paper/2105.08252","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:54dea35480238f0f9c44bf3f4eb1233338656fd1fb8a9096688bf78e6b0b5325","observation_id":"7fc004dd-da0e-4c14-acc9-bd72e5bab419","resolution":{"observed_at":"2026-08-11T13:49:18.383065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.386703Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.386703Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:8fb7bc010199c1fff53fb62cf4d5801cf1fe31754664ea7ab3997ead2d277e1c","observation_id":"1324f9f0-2db7-4a67-9d58-d10c5ee96221","resolution":{"observed_at":"2026-08-11T13:49:18.386703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.570803Z","title":"H.; Miech, A.; Pont-Tuset, J.; Laptev, I.; Sivic, J.; and Schmid, C","venue":null,"work_id":"43aa9870-0de8-4038-aed2-afffd6b7a859","year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.389759Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:2fdd5cf201a29a57868bd099d37f2b0c414937fd2a27dca2974a93c51aa9addf","observation_id":"a8e422dd-524b-48c2-b007-7c835cd80b7a","resolution":{"observed_at":"2026-08-11T13:49:18.575206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.560041Z","title":null,"venue":null,"work_id":"3b496a19-458d-44c7-b343-5ab46232937e","year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.393187Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:ef242a239167de9f852339220cf027acc4dce0e4278eb984b767375b354b0ed0","observation_id":"5e5a10bb-333e-402b-9e54-1238f86df12f","resolution":{"observed_at":"2026-08-11T13:49:18.563460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.549153Z","title":null,"venue":null,"work_id":"1597ed42-ee30-4964-b598-fd8d660cbdd4","year":2024},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.396030Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:65142437794a9a671bc07fc921fc386074693e616374ed4fdac9ef6eca1fff36","observation_id":"4fb62749-79d8-4d70-8327-e9efdc397fae","resolution":{"observed_at":"2026-08-11T13:49:18.552589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.537870Z","title":null,"venue":null,"work_id":"068c00bf-c579-421b-b12b-e6456b543bdf","year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.398906Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:2102690a5d6ef8e534ebd0fe8cb63b76d3679aec5b31c3bae1d34d8c685fe777","observation_id":"9e6e5248-14db-4190-95ab-5be43305fde1","resolution":{"observed_at":"2026-08-11T13:49:18.541644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.526101Z","title":null,"venue":null,"work_id":"326e7ab3-d200-414b-987d-08c028343b28","year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.401773Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:99a8a952027142435d9d2de5cda2ecac6c2a1b64f126338e9b695840b83243d8","observation_id":"78968094-e592-4241-97a3-5e46680fde8b","resolution":{"observed_at":"2026-08-11T13:49:18.530303Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.404693Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.404693Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:2eb3f768fa37fe7d277ab92bfde01a9f0ecb81772cafa8e52df7acc38baa840f","observation_id":"91c197e7-b8d5-483a-a584-de6f005f69b5","resolution":{"observed_at":"2026-08-11T13:49:18.404693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-11T13:49:18.407604Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.407604Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:8368121125a41865f1dba05e9e93942b7f94d343238730019bb77bb29efc0345","observation_id":"b711890a-9bcf-49c9-b859-12a14dd03214","resolution":{"observed_at":"2026-08-11T13:49:18.407604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08121","last_updated":"2022-09-16T05:44:53Z","snapshot_observed_at":"2026-08-16T17:06:25.534936Z","submitted_at":"2022-04-18T01:30:54Z","title":"End-to-end Dense Video Captioning as Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08121","snapshot_observed_at":"2026-08-11T13:49:18.410885Z","title":"V.; Wang, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.410885Z"},"links":{"cited_paper":"/paper/2204.08121","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:ca09779f024ddaf32d30e50ce675d081c13359e1fc8ddb1c3c3cb3087e6c0e4d","observation_id":"69a472e1-5120-40cc-8d91-4a18553cd671","resolution":{"observed_at":"2026-08-11T13:49:18.410885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T04:36:15.938718Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.12791."}