{"as_of":"2026-08-13T16:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0f70b8f589b8c7e2df84433c491f980af2ab73303ddd22400f862998bc9c1a2c","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:50:59.205085Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:11:07.359765Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T21:11:07.571282Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"cited_work":{"arxiv_id":"2412.03093","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03093","snapshot_observed_at":"2026-08-12T21:11:07.571282Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","venue":"cs.CV","work_id":"d0a375e7-da61-46d9-bc9b-cb64c0edbe35","year":2024},"citing_paper":{"arxiv_id":"2411.09072","last_updated":"2025-01-14T00:21:51Z","snapshot_observed_at":"2026-08-13T14:47:11.498101Z","submitted_at":"2024-11-13T22:55:45Z","title":"Continuous GNN-based Anomaly Detection on Edge using Efficient Adaptive Knowledge Graph Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T21:11:07.359765Z"},"links":{"cited_paper":"/paper/2412.03093","citing_paper":"/paper/2411.09072"},"observation_digest":"sha256:4cf0166d14206d85153e78a0b70087c2363f6eb2ecc71ea58bad7f64042456c3","observation_id":"ed8b3608-7fe0-4662-8ff6-435354978716","resolution":{"observed_at":"2026-08-12T21:11:07.578297Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03093/citation-record","integrity":"/paper/2412.03093/integrity","json":"/paper/2412.03093/citation-record.json","paper":"/paper/2412.03093"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.11211","last_updated":"2024-11-26T09:28:35Z","snapshot_observed_at":"2026-08-13T14:47:12.067218Z","submitted_at":"2024-07-15T19:53:02Z","title":"Unconstrained Open Vocabulary Image Classification: Zero-Shot Transfer from Text to Image via CLIP Inversion","version":4},"cited_work":{"arxiv_id":"2407.11211","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11211","snapshot_observed_at":"2026-08-11T22:50:59.547538Z","title":"Unconstrained Open Vocabulary Image Classification: Zero-Shot Transfer from Text to Image via CLIP Inversion","venue":"cs.CV","work_id":"e5f32c7b-f2f2-4bb3-b9a1-52d54d20599a","year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.885676Z"},"links":{"cited_paper":"/paper/2407.11211","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:22fd7cdb6776b76ccd1401807b837b0732e5d4b261d5ca3503174821de3e1284","observation_id":"5a3803d5-f844-40b9-b0e2-2d1dd701cf12","resolution":{"observed_at":"2026-08-11T22:50:59.554755Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.428032Z","title":"Learning to prompt clip for monocular depth estimation: Exploring the limits of human language","venue":null,"work_id":"4115de32-8de8-4369-b236-d1f352bda4ed","year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.891175Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:e5677b02def2d10a5a569a0454dd84165efddc972c126d19dc19f915acd1a4ea","observation_id":"21aaf855-2519-4707-9cb8-c6a27c331f11","resolution":{"observed_at":"2026-08-11T22:51:00.433416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.412339Z","title":"Graph-based object classifica- tion for neuromorphic vision sensing","venue":null,"work_id":"20551c9e-2c17-4810-abc1-44657cc249fe","year":2019},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.895537Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:773fe3ecec31338321599beab2e35950c5fae740ebe49d88d95d90cb6e9d014a","observation_id":"eb684b8d-ab9e-4dc2-9641-c8fa36a46e46","resolution":{"observed_at":"2026-08-11T22:51:00.417437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:58.900169Z","title":"A differentiable recurrent surface for asynchronous event-based data","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.900169Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:f897aa5b5c7f3bf3b45be62e6e9c4510f3d3d7a9b250e1b749dd7e93807a7a20","observation_id":"99e2be03-d3e9-4f23-9226-c565ca6f72d1","resolution":{"observed_at":"2026-08-11T22:50:58.900169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13627","last_updated":"2024-08-27T14:14:51Z","snapshot_observed_at":"2026-08-12T22:58:06.286278Z","submitted_at":"2024-08-24T16:48:25Z","title":"Recent Event Camera Innovations: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13627","snapshot_observed_at":"2026-08-11T22:50:58.904660Z","title":"Recent event camera innovations: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.904660Z"},"links":{"cited_paper":"/paper/2408.13627","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:97342cea566091b027fba0ea7cde3607765d8a128851c9f0ed42c66fd5daaedf","observation_id":"26243ba6-08ed-428d-a34b-bdb8d6887a49","resolution":{"observed_at":"2026-08-11T22:50:58.904660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:58.909239Z","title":"Generic attention- model explainability for interpreting bi-modal and encoder- decoder transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.909239Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:ec70132fc43d66ee1494dbc38e306cdbfd5b8cf98e5d2c6ddae4df1e1ea1c299","observation_id":"aee9cbf6-abff-4961-bce8-536885420f46","resolution":{"observed_at":"2026-08-11T22:50:58.909239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.377444Z","title":"Image-based clip-guided essence transfer","venue":null,"work_id":"89290b09-40e4-41a7-9c5f-8fec9cbdeedf","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.913988Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:b48574d0c7be1fdeadee97643d43f6ec0c66416aaff6fc883a6c9b5976543ced","observation_id":"480333b1-dff8-459d-bfc2-3aa1abd5ae4a","resolution":{"observed_at":"2026-08-11T22:51:00.382619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00927","last_updated":"2024-07-11T00:38:08Z","snapshot_observed_at":"2026-08-13T05:59:38.366099Z","submitted_at":"2023-10-02T06:41:30Z","title":"Understanding Transferable Representation Learning and Zero-shot Transfer in CLIP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00927","snapshot_observed_at":"2026-08-11T22:50:58.918866Z","title":"Understanding transferable representation learning and zero- shot transfer in clip","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.918866Z"},"links":{"cited_paper":"/paper/2310.00927","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:42bff23209b18dd9c0b2033a932834ee41d4e3bf405b88d0b4c541fc199da731","observation_id":"aa6fdf6f-8c32-4c59-b456-ed63bda860e1","resolution":{"observed_at":"2026-08-11T22:50:58.918866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.361939Z","title":"Transfer clip for gen- eralizable image denoising","venue":null,"work_id":"73b2ca22-c605-4f60-80b8-1827f12a806e","year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.924531Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:63dcdc27335a78b2ebd492aeebe49e4990cd8d578e0dea0149f1f49d1559e209","observation_id":"67ed22b5-5dd1-457f-979a-7a765117fb13","resolution":{"observed_at":"2026-08-11T22:51:00.367097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.346536Z","title":"Label-free event-based object recognition via joint learning with image reconstruction from events","venue":null,"work_id":"b239ecfb-9a08-4670-b7d8-7f3aef25e347","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.929215Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:cf9b6c0b15f31d2cd074e4b2a1a94b8dcf31d0cfe7e19e2cf0235ec74c20c61f","observation_id":"ae8588e5-f47e-4675-a62b-d32245793f08","resolution":{"observed_at":"2026-08-11T22:51:00.351572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:58.933715Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.933715Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:1649a8e38764841cf50cf4cf279d66efb776b49b6a0836d805c598e127d8c999","observation_id":"821f10f3-40db-4eb5-9a7f-7e2762fc03f1","resolution":{"observed_at":"2026-08-11T22:50:58.933715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:58.938395Z","title":"Event-based vision: A survey","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.938395Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:c447aaa54d0f388b83e9cf9d099b0c42f8f45403354337f55f0b856038039e22","observation_id":"9ec5e25b-5e50-4012-8c8b-bc700b095cc4","resolution":{"observed_at":"2026-08-11T22:50:58.938395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:58.942907Z","title":"Clip-adapter: Better vision-language models with feature adapters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.942907Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:5525be3987bcddf3eb18eebf4c6a68dbb5fe333e87e736cd75f3f4157131b1fb","observation_id":"6525283f-46b6-4912-a813-9c16659e70fb","resolution":{"observed_at":"2026-08-11T22:50:58.942907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.301720Z","title":"End-to-end learning of repre- sentations for asynchronous event-based data","venue":null,"work_id":"599a4e4c-f8c6-452b-95f0-20807edf1b37","year":2019},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.947666Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:0dab6145ff7bc8930448c74a692c7d56ba87b9460db92cee125fa17b84102cdb","observation_id":"b75a3667-2d90-42c7-a3e8-77ce2902b382","resolution":{"observed_at":"2026-08-11T22:51:00.306212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:58.952187Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.952187Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:e32a6b347a29d4f7b85c66fb44475acb3dba79945bae5dbec668f944e9a1b03d","observation_id":"dff4b428-4070-449a-b297-5a12a913d13f","resolution":{"observed_at":"2026-08-11T22:50:58.952187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.276678Z","title":"Cyclip: Cyclic contrastive language-image pretraining","venue":null,"work_id":"46be4cfa-967c-4f63-ade8-6d3571c934ab","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.956599Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:dfdf248bd4025e817af30a5c67fcd23d947ff60f1c8404ee60070fc3b5212a4b","observation_id":"18402977-93d2-46b5-ab04-9e28f98c9812","resolution":{"observed_at":"2026-08-11T22:51:00.281357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05836","last_updated":"2021-06-07T11:53:14Z","snapshot_observed_at":"2026-07-06T11:18:02.906996Z","submitted_at":"2021-06-07T11:53:14Z","title":"EventDrop: data augmentation for event-based learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.05836","snapshot_observed_at":"2026-08-11T22:50:58.961315Z","title":"Eventdrop: Data augmentation for event-based learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.961315Z"},"links":{"cited_paper":"/paper/2106.05836","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:31eaa5314c0aae0d05d634ec8fcd321d0069b210197c0ad998429445f625ebd5","observation_id":"f8cc1f31-9f7d-4acd-99a8-3a3b7e68e90a","resolution":{"observed_at":"2026-08-11T22:50:58.961315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13921","last_updated":"2022-05-12T01:27:40Z","snapshot_observed_at":"2026-08-08T10:08:57.896975Z","submitted_at":"2021-04-28T17:58:57Z","title":"Open-vocabulary Object Detection via Vision and Language Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13921","snapshot_observed_at":"2026-08-11T22:50:58.966310Z","title":"Open-vocabulary object detection via vision and language knowledge distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.966310Z"},"links":{"cited_paper":"/paper/2104.13921","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:2c518aeabda0718dcabec786f168da4197b0826622e0945030a8383ae043483b","observation_id":"d05b3de5-a5e3-44e6-a307-84faf0566dbb","resolution":{"observed_at":"2026-08-11T22:50:58.966310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.262233Z","title":"Cliptrans: trans- ferring visual knowledge with pre-trained models for multi- modal machine translation","venue":null,"work_id":"a0fc935d-aa39-47bd-8a52-d910546fbc7a","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.971400Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:aefdf9d1594be1e9dd195d000c40d789dfa499d142446eec49e28fd51a596817","observation_id":"f10f3fc0-618c-4b23-b88e-a0ae84a32d77","resolution":{"observed_at":"2026-08-11T22:51:00.267130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.246859Z","title":"Audioclip: Extending clip to image, text and au- dio","venue":null,"work_id":"29ed7269-0088-43aa-8773-54dcbcd2c621","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.976575Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:8e53042e491a6826e0503d8bc0aec89bc19c88741df8861b0d6652473da866ea","observation_id":"cbb52e21-8882-4bb8-978e-77107628dd1d","resolution":{"observed_at":"2026-08-11T22:51:00.251795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.231574Z","title":"Lidarclip or: How i learned to talk to point clouds","venue":null,"work_id":"e96c31d8-f8e7-4ac6-9585-c15712f7f0a1","year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.981508Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:d620462860d26ef24f946938baac1da6b1bfca16d4192e9bba03951c255a5974","observation_id":"4ab15f38-f9fd-4267-b5fe-dbdcc8dfd211","resolution":{"observed_at":"2026-08-11T22:51:00.236514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.216758Z","title":"Learning monocular dense depth from events","venue":null,"work_id":"7a8fc9a6-62dd-4847-9576-15e69bf9c2f4","year":2020},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.985914Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:e892a901a42e0d7b1bf7aae5ddb8582ec4468ce0ef60ada88f1cccf7759d5854","observation_id":"e51c5ef6-3c2b-47c2-a15e-27c33a327757","resolution":{"observed_at":"2026-08-11T22:51:00.221553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.202114Z","title":"Clip2point: Transfer clip to point cloud classifica- tion with image-depth pre-training","venue":null,"work_id":"9865b021-c77e-4f03-98ec-074a2b74a274","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.990327Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:d0e3c86a8e2ba34a5484d82a2d26643310872bf2a6c9794a50ab81207fa842f0","observation_id":"21a750da-7840-47ff-a6dd-24be073fac6c","resolution":{"observed_at":"2026-08-11T22:51:00.206923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.187566Z","title":"Transferring pre-trained multimodal rep- resentations with cross-modal similarity matching.Advances in Neural Information Processing Systems, 35:30826–30839,","venue":null,"work_id":"d3be00bb-dde3-461f-ab91-cc61214ab2ee","year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.994950Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:11d289153918cb87a03f5eec54c29712705d505d6037c526d3ca75833a93cd3b","observation_id":"cb4d03dd-41ab-410b-afb9-ee46c30d5b43","resolution":{"observed_at":"2026-08-11T22:51:00.192561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.172519Z","title":"N-imagenet: Towards robust, fine-grained object recognition with event cameras","venue":null,"work_id":"27e60e44-988d-447b-ad35-632699bbcb45","year":2021},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:58.999832Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:855c03af488d907b832ea0b999c7d8b55a127ec6ba81b7fbb0e194bbbf61089a","observation_id":"38763687-7684-490b-b514-2fa62c9a0fc6","resolution":{"observed_at":"2026-08-11T22:51:00.177439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.157475Z","title":"Masked event modeling: Self-supervised pretraining for event cameras","venue":null,"work_id":"97c037e9-4492-4de0-abde-034749c0d4cb","year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.004538Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:588293f5b1cd113d5ed1a855719cc66f54c2839231cc36becffd25c86ca9f521","observation_id":"aacfd93b-eb1c-46fd-895b-00de0a73496d","resolution":{"observed_at":"2026-08-11T22:51:00.162450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.141159Z","title":"Graph-based asyn- chronous event processing for rapid object recognition","venue":null,"work_id":"1d899267-435c-4b32-8806-9974314a251c","year":2021},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.009309Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:4f51bfd0ab9e7be46651c842db526fadc91ba728251c0343bd4d7847dcf69f7e","observation_id":"b8e4a749-3b78-4b57-8dbb-540a101cc57d","resolution":{"observed_at":"2026-08-11T22:51:00.146500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.125832Z","title":"A 128×128 120 db 15 µs latency asynchronous temporal con- trast vision sensor","venue":null,"work_id":"3068a233-675f-4b14-8a33-c580f7ec175f","year":2008},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.014054Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:41d9def8f9ca56fa971bfbe2c8524ecbda5f065abf131ba1b86794837c6e4233","observation_id":"4b9817b1-5673-4b39-b5ee-65e15572118c","resolution":{"observed_at":"2026-08-11T22:51:00.130610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.110049Z","title":"Fast classification and action recognition with event-based imaging","venue":null,"work_id":"991f08dc-f61c-4640-af8a-dac170cecc2f","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.019107Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:b59d8cc9c43cd1721b9e22142c7b3276434b73aecb75f8e3a99b252a4b100000","observation_id":"ce31b631-7d20-47b8-9215-dff4762ae36b","resolution":{"observed_at":"2026-08-11T22:51:00.115128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.093706Z","title":"Revisiting temporal modeling for clip-based image-to-video knowledge transferring","venue":null,"work_id":"1c21b99f-fabd-41dc-a3b4-8397b6414677","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.023635Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:ffe9472a7d899b9b2dedadb425e1d55cd74fed9a8ee0103f107949a99f63f301","observation_id":"d76037cb-227c-4add-b0ea-d28d86e55093","resolution":{"observed_at":"2026-08-11T22:51:00.098636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.078837Z","title":"A revisit of sparse coding based anomaly detection in stacked rnn framework","venue":null,"work_id":"32fc03a3-8c77-4939-8f18-9838c75e030b","year":2017},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.028113Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:22c3e32c6ba73a959a96e6b315d45eb502f81fc233a7ef2ad90ec07b64681f90","observation_id":"c31ee535-63f5-44d5-b71d-4fc4b8911437","resolution":{"observed_at":"2026-08-11T22:51:00.083593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.062331Z","title":"Event-based asynchronous sparse con- volutional networks","venue":null,"work_id":"7dd15aee-3993-410f-b1b7-b70b916767ee","year":2020},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.032607Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:3c9e20e31115529ac5cf7b5ef7a9dc0634a6a024d156075bce64ce3fd54c1acc","observation_id":"610a87d8-6882-4d0a-a88c-51ebcfba46d2","resolution":{"observed_at":"2026-08-11T22:51:00.067564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-11T22:50:59.036732Z","title":"Repre- sentation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.036732Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:426a96a8f84c81101259f52028c455a1df995fff5f850eea624b91098c37b77d","observation_id":"b9d7b78a-05da-45da-9e93-43dbc95d8ce5","resolution":{"observed_at":"2026-08-11T22:50:59.036732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.044665Z","title":"Converting static image datasets to spiking neuromorphic datasets using saccades","venue":null,"work_id":"9275779c-99b1-458a-9620-8d698231416c","year":2015},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.041271Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:3e3aeedc50aa3321860af0649b95bd2b514db274e675aa7eecf4387d7d186519","observation_id":"e903d5c0-4ae6-4e1e-ba89-ce6e30a1c2ac","resolution":{"observed_at":"2026-08-11T22:51:00.049682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:51:00.022860Z","title":"St-adapter: Parameter-efficient image-to-video transfer learning","venue":null,"work_id":"e66094fe-3357-4218-b9c9-1f2dd7a04354","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.045553Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:61b1cccd8c186ddf8d3997bd3cba2d5ee54d400e9b8dc36d321f585a118557a6","observation_id":"ba2d2925-aacc-4ad5-9998-6987f24a9ff5","resolution":{"observed_at":"2026-08-11T22:51:00.030027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.997102Z","title":"Back to event basics: Self-supervised learning of image reconstruc- tion for event cameras via photometric constancy","venue":null,"work_id":"bf9e8b70-0168-4ff9-b95f-ebaeecf9cd2f","year":2021},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.049815Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:215f460f98675d7ee94918b6cd07811f09f8d5fc6b87c7121912f07b1e81491c","observation_id":"a45bbe5c-8f3f-44b8-9287-82c7e912bc46","resolution":{"observed_at":"2026-08-11T22:51:00.003968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.981692Z","title":"Ecodepth: Effective conditioning of diffusion models for monocular depth estimation","venue":null,"work_id":"60d8ab77-1bae-4244-ae46-a8d37449f87c","year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.054048Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:0ce7d5ec552d3072456277bc81d087f31df00ec2d60948e1dbaa1cadb059f3db","observation_id":"1c8d35f9-b3af-40f9-8798-e83fa468ea0a","resolution":{"observed_at":"2026-08-11T22:50:59.986866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.966433Z","title":"Esc: Dataset for environmental sound classi- fication","venue":null,"work_id":"c5930601-ab36-4ce5-80c4-63e8d5569f02","year":2015},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.058301Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:d69d4f14529e3059d5896f71a5d210bf763a15ac15a80d034753dc18cfe2f4f8","observation_id":"1d08db6c-b962-442c-a151-871459664118","resolution":{"observed_at":"2026-08-11T22:50:59.971263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.062483Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.062483Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:7160ded902b7e8c3986a657d8a483e2fc975019ecf06619ef36f50011aceaea3","observation_id":"ecbe0db7-8e86-475d-83e9-a32fb68fb399","resolution":{"observed_at":"2026-08-11T22:50:59.062483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.941054Z","title":"Events-to-video: Bringing modern computer vision to event cameras","venue":null,"work_id":"7af88175-03bc-4272-bee1-2b1cb464a6bd","year":2019},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.066835Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:a14bb4a7a1b3acf3b9437f68e4defd60e22dc6c1787b6fee01c5cec753efa7d3","observation_id":"0be796d2-49a0-49be-8103-34442c6f9ae2","resolution":{"observed_at":"2026-08-11T22:50:59.945811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.923986Z","title":"Aegnn: Asynchronous event-based graph neural networks","venue":null,"work_id":"06e6fecd-a7f1-4f71-92f4-329743765725","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.071339Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:153bdf0c471d10ccdebca858729613073e21de4381b81cbc0092b6791788de34","observation_id":"8143f752-74fa-4110-ac9b-5f1c3f1e5646","resolution":{"observed_at":"2026-08-11T22:50:59.930028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.905542Z","title":"Towards understanding the modality gap in clip","venue":null,"work_id":"fbac1dff-4a26-492b-b73a-1ff2321343b0","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.075846Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:c3e906f8fedfc11735965965a80a230d0290aa141926e6d8b17ea32ab54b30df","observation_id":"c90db542-dcfe-4075-af68-8cd57408210d","resolution":{"observed_at":"2026-08-11T22:50:59.911004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.888448Z","title":"Speechclip: Integrating speech with pre-trained vision and language model","venue":null,"work_id":"a22ae30d-3a3d-47d7-9019-bf60399e367c","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.080601Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:2d910f248510dbc8af715675b37d463c468b29bed0b5daf68571d72a7a423e2b","observation_id":"a8980ce5-4d15-4c1b-b3fe-8b58a2602538","resolution":{"observed_at":"2026-08-11T22:50:59.894007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.871169Z","title":"Hats: Histograms of aver- aged time surfaces for robust event-based object classifica- tion","venue":null,"work_id":"ee6c026a-cb6d-41d1-9b3a-16e127096d82","year":2018},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.085198Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:cf5e970e026518b105405df3aeba210c94241bd34d43e464815797bb3148d2b8","observation_id":"11182a22-d430-4fda-a36d-2a4509b13efd","resolution":{"observed_at":"2026-08-11T22:50:59.877001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.852389Z","title":"Real-world anomaly detection in surveillance videos","venue":null,"work_id":"2fc15e0a-3a7f-4a4a-b3ae-dbdac92c4dcd","year":2018},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.090125Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:32b40776fa70e59543c45b624257ed5e173522cc5af81be61002e3bf46c6b5cd","observation_id":"b33dcb96-d29c-4b9a-868e-fbe91c00ce65","resolution":{"observed_at":"2026-08-11T22:50:59.859060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.835087Z","title":"Weakly-supervised video anomaly detection with robust temporal feature magni- tude learning","venue":null,"work_id":"9fcda9c3-5c1a-4213-b86e-c07fc004c028","year":2021},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.094730Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:a0e0c4ce3f17ed82d07a2400dc17992f00ba8478a8bbda4369b5b932d9e36502","observation_id":"263d39e2-db51-4d79-b7da-c8e824d18a69","resolution":{"observed_at":"2026-08-11T22:50:59.841057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.099593Z","title":"Clipn for zero-shot ood detection: Teaching clip to say no","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.099593Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:e0a5de4e7d0af3432260e9dd2b7d5c75bfc8608d6efaccc3fa046e5045fcd568","observation_id":"7983bc49-3237-428b-beeb-dc132f7648a4","resolution":{"observed_at":"2026-08-11T22:50:59.099593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.804888Z","title":"Ev-gait: Event- based robust gait recognition using dynamic vision sensors","venue":null,"work_id":"e45c2ba7-f416-4972-93fa-ff84cdd160a4","year":2019},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.104100Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:c32836bd24db7dc215e89a86ab64c08273d3e5782498c3b4f1c994448c011da6","observation_id":"9a4916f5-f44c-4cd2-b026-16ebf663c7d5","resolution":{"observed_at":"2026-08-11T22:50:59.809896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.786149Z","title":"Transferring clip’s knowledge into zero-shot point cloud semantic seg- mentation","venue":null,"work_id":"0ece4b22-cd0a-437f-85d7-d3fe9eef1187","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.108998Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:c67ebfc03a1d41010a963d16efb65a0b70bd2791abe307146e7c6ed5c94d6bb3","observation_id":"222294a2-f625-4ea9-9c6c-353d409e862c","resolution":{"observed_at":"2026-08-11T22:50:59.793298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.766679Z","title":"Exploiting spatial sparsity for event cameras with visual transformers","venue":null,"work_id":"17bf4821-87a1-4739-86bf-8e6f3dac75b2","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.114001Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:61cf5880d2041c1f83126d750ecd326e7ac71b6621af2ff0f957b2fd44c3cd48","observation_id":"a38b14db-b490-42a5-b068-6f7016b2f919","resolution":{"observed_at":"2026-08-11T22:50:59.772319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.749155Z","title":"Improving zero-shot generalization for clip with synthesized prompts","venue":null,"work_id":"8555f7d0-f264-4b7b-b04c-89a2506c41e9","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.118718Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:727c835374e61f4a2f51b22ffbbcd016b5888ff1b8e874e0d039f51fe69e711e","observation_id":"b9dd9e0b-0e7c-4526-aced-5c5066f0178f","resolution":{"observed_at":"2026-08-11T22:50:59.755069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.729654Z","title":"Wav2clip: Learning robust audio repre- sentations from clip","venue":null,"work_id":"dd81ce20-dbd6-4913-8186-0de3d7e231b9","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.123455Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:73c1d852ab2f1611a2cfa1de61649e17a878f3b443e013971ff43ccd54c17891","observation_id":"18b32784-3ca4-45f3-bca4-73dc4cd275e3","resolution":{"observed_at":"2026-08-11T22:50:59.736793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06354","last_updated":"2023-11-16T19:26:02Z","snapshot_observed_at":"2026-08-13T11:19:51.690629Z","submitted_at":"2023-06-10T06:05:35Z","title":"EventCLIP: Adapting CLIP for Event-based Object Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06354","snapshot_observed_at":"2026-08-11T22:50:59.128397Z","title":"Eventclip: Adapting clip for event-based object recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.128397Z"},"links":{"cited_paper":"/paper/2306.06354","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:ff2cf5dd8fda44abb2acb601054b085bbf6ebf689f66c6f95d021b4a8be68a8c","observation_id":"4d0a44aa-cd69-436a-932c-a1b353d559ce","resolution":{"observed_at":"2026-08-11T22:50:59.128397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.704141Z","title":"Event camera data pre-training","venue":null,"work_id":"6a3ffd15-eafe-4b1f-bd76-f8045ff62e7d","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.133543Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:05e73bfa3dc957e7214839077d5ee7eebb0f23b762e54d47dbae0930107b33a9","observation_id":"89907a92-55ef-41c4-b7d4-18babd47e028","resolution":{"observed_at":"2026-08-11T22:50:59.709095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.138237Z","title":"Event-guided low- light video semantic segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.138237Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:f1876525eadb8a9518cc99f95f1ed370e18ca208f51f2a15212b7fa51aabb21f","observation_id":"2c8cb96e-955c-4098-a4ff-bd3a07fd7c3c","resolution":{"observed_at":"2026-08-11T22:50:59.138237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.689191Z","title":"Clip2: Contrastive language- image-point pretraining from real-world point cloud data","venue":null,"work_id":"e3d7376e-8da0-4976-ae4f-8e41b4e61abc","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.143005Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:a60fafaf317edfa9427bbaa6cb4820156af80ea9f3fad5d7ae47420bda6848c8","observation_id":"219accb7-f14a-47e9-b123-0bd5e55f2d29","resolution":{"observed_at":"2026-08-11T22:50:59.694032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.147647Z","title":"Vision-language models for vision tasks: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.147647Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:96f9051dec64200ffbd66eb1de435746124a98de51d231bd00eb0a856af82edf","observation_id":"6543e224-f664-4552-bb42-c0293b2afbe2","resolution":{"observed_at":"2026-08-11T22:50:59.147647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.152995Z","title":"Pointclip: Point cloud understanding by clip","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.152995Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:e229b4c9148015f642b92679524fc4bb469301806597b5f39e336316c0313699","observation_id":"62302795-f6d8-4aa6-985e-2b3f2f64be63","resolution":{"observed_at":"2026-08-11T22:50:59.152995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.656035Z","title":"Can language understand depth? In Proceedings of the 30th ACM International Conference on Multimedia, pages 6868–6874,","venue":null,"work_id":"9edb58c6-eb13-4b84-80ea-dbc98eea2983","year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.157632Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:28fb954ee42228970e05ec2fe9f043f53135f2ce04ac8f8544a8a8232fb7df97","observation_id":"709d7b41-c539-405b-be9b-6cd80f411f32","resolution":{"observed_at":"2026-08-11T22:50:59.660915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.640340Z","title":"Tip- adapter: Training-free adaption of clip for few-shot classi- fication","venue":null,"work_id":"899f7a0e-afa4-446d-a9a2-9067cc09fd12","year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.163001Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:ad8996eb659fdde728e509ef614a512421c3fa6aeff3c937f3462206c63eb581","observation_id":"be37f930-1e1e-4df5-b071-e24d318eb53f","resolution":{"observed_at":"2026-08-11T22:50:59.645427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.168079Z","title":"Eventdance: Unsupervised source- free cross-modal adaptation for event-based object recogni- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.168079Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:208fda7b9ae564991a0bab1d8ef6f506dcafa43d49cc848d1d6d548abd5e67c6","observation_id":"4d696e3a-5504-4bf1-bf75-2c953456a5a9","resolution":{"observed_at":"2026-08-11T22:50:59.168079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08890","last_updated":"2024-04-11T15:34:46Z","snapshot_observed_at":"2026-08-13T12:42:44.235949Z","submitted_at":"2023-02-17T14:19:28Z","title":"Deep Learning for Event-based Vision: A Comprehensive Survey and Benchmarks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08890","snapshot_observed_at":"2026-08-11T22:50:59.172895Z","title":"Deep learning for event-based vision: A comprehensive survey and bench- marks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.172895Z"},"links":{"cited_paper":"/paper/2302.08890","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:0e5f3d72bddb5957c32dff67ab4d393dfebc5d53b4235762ffeb60468ee6909f","observation_id":"1729ad24-a7d8-45bb-865d-b702ea4f1737","resolution":{"observed_at":"2026-08-11T22:50:59.172895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.614049Z","title":"Preventing zero-shot transfer degradation in continual learning of vision-language mod- els","venue":null,"work_id":"69e0bad1-a984-41f5-828d-eb795782fcd5","year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.177859Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:fc2576f5d7c9deb3a2c24e4461a4b25b2ca2f54fee76f60fcb4c860aa860065d","observation_id":"5faf4cd9-bc2a-48e3-97e1-14d0023a07a4","resolution":{"observed_at":"2026-08-11T22:50:59.619395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.598741Z","title":"Regionclip: Region- based language-image pretraining","venue":null,"work_id":"d5bab124-14e5-49da-8e1f-daca6b0b1c2f","year":2022},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.182321Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:31fc88a7f47f5a82fbe8624df5fefc7d046c16533c03686e8b0a6784cca5c40d","observation_id":"3c1a4a4b-bc96-4dff-b5a0-0b2f641e11b1","resolution":{"observed_at":"2026-08-11T22:50:59.603685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03135","last_updated":"2024-07-24T13:50:56Z","snapshot_observed_at":"2026-08-13T10:39:53.538985Z","submitted_at":"2023-08-06T15:05:42Z","title":"EventBind: Learning a Unified Representation to Bind Them All for Event-based Open-world Understanding","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03135","snapshot_observed_at":"2026-08-11T22:50:59.186930Z","title":"E- clip: Towards label-efficient event-based open-world under- standing by clip","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.186930Z"},"links":{"cited_paper":"/paper/2308.03135","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:899bf7554eddd03d89d9f7329ae010db717699a0faba1c669cf6b6b67d3e490c","observation_id":"0215a477-74e3-46bc-9a79-ef3bd1cb3c63","resolution":{"observed_at":"2026-08-11T22:50:59.186930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.583068Z","title":"Eventbind: Learning a unified representation to bind them all for event-based open-world understanding","venue":null,"work_id":"999cf2c3-006d-4fe1-973d-6e2241753dc6","year":2024},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.191727Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:52399a511ef4995ec577a85421a5d48917c901a46528a099dbf8d80352f6c0ba","observation_id":"5f7b8734-13ba-4d03-8bc9-23fc078b2407","resolution":{"observed_at":"2026-08-11T22:50:59.587898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.196331Z","title":"Anomalyclip: Object-agnostic prompt learn- ing for zero-shot anomaly detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.196331Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:91750c42acafa4ad8896e806509e91861dd67c275dcbced4ee3ada31d95f9c27","observation_id":"6af4ced4-d257-4474-aab1-5bc29f273ffb","resolution":{"observed_at":"2026-08-11T22:50:59.196331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:50:59.566912Z","title":"A brief introduction to weakly supervised learning","venue":null,"work_id":"697b69f3-2b2a-4678-92e7-a716f70dc380","year":2018},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.200685Z"},"links":{"citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:5dbfbaa759207836be6cef32ed778098cb34247793b39df89d2acb3ea13b2e57","observation_id":"02bf9f7d-2fd7-4689-bd2e-37722b975cfa","resolution":{"observed_at":"2026-08-11T22:50:59.571875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01852","last_updated":"2024-01-22T03:11:15Z","snapshot_observed_at":"2026-08-07T05:10:33.059352Z","submitted_at":"2023-10-03T07:33:27Z","title":"LanguageBind: Extending Video-Language Pretraining to N-modality by Language-based Semantic Alignment","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01852","snapshot_observed_at":"2026-08-11T22:50:59.205085Z","title":"Languagebind: Extending video-language pretrain- ing to n-modality by language-based semantic alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T22:50:59.205085Z"},"links":{"cited_paper":"/paper/2310.01852","citing_paper":"/paper/2412.03093"},"observation_digest":"sha256:6f4b993622a1f13eb6e92b9d6b0d2b96715c7d36cbca0e0802389c2c070df03e","observation_id":"6f641583-3407-4a50-abe9-08ecb4bcf23a","resolution":{"observed_at":"2026-08-11T22:50:59.205085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.03093","last_updated":"2025-05-08T09:35:41Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T22:44:51.817797Z","submitted_at":"2024-12-04T07:44:58Z","title":"Expanding Event Modality Applications through a Robust CLIP-Based Encoder"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":46},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2412.03093."}