{"as_of":"2026-08-15T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9afd491518115bcbef2c23828b6c04becfb75a9e86c0c13cc9bbc05cacc3e31b","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:46:32.156707Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:13:41.628236Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T19:13:41.943876Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"cited_work":{"arxiv_id":"2502.05843","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05843","snapshot_observed_at":"2026-08-15T19:13:41.943876Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","venue":"cs.CV","work_id":"aac70872-1a9d-4a1d-82dc-d0fc47390b94","year":2025},"citing_paper":{"arxiv_id":"2506.17457","last_updated":"2025-06-20T19:58:38Z","snapshot_observed_at":"2026-08-15T19:06:14.838328Z","submitted_at":"2025-06-20T19:58:38Z","title":"When Every Millisecond Counts: Real-Time Anomaly Detection via the Multimodal Asynchronous Hybrid Network","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T19:13:41.628236Z"},"links":{"cited_paper":"/paper/2502.05843","citing_paper":"/paper/2506.17457"},"observation_digest":"sha256:f408ac9f64d06ab7e2d6efa67a8245c12d7287c59b2428797a5c3cf301c889d4","observation_id":"eba8a8c5-5484-43cf-9225-0da01cbd30f9","resolution":{"observed_at":"2026-08-15T19:13:41.997454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05843/citation-record","integrity":"/paper/2502.05843/integrity","json":"/paper/2502.05843/citation-record.json","paper":"/paper/2502.05843"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.284756Z","title":null,"venue":null,"work_id":"8dd5f0ff-17a5-445a-96bb-6ebf666219d9","year":2016},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.811317Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:03d52b0907a8e09304b36140276e47b68ccb28596e96850367af82344bfeb537","observation_id":"42752aca-6e8a-4752-8c1e-b02eb0360dee","resolution":{"observed_at":"2026-08-08T17:46:33.289532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.268664Z","title":"Neuro-symbolic visual rea- soning: Disentangling","venue":null,"work_id":"6ff667d6-45e6-4a65-b29d-b1df18ee39cf","year":2020},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.816992Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:63f2701d1a754d65987a93b0dfd7ccbf76c7330219c5777d38a40810810a0ed6","observation_id":"c271d358-b5bc-422b-9734-aa821d6bc689","resolution":{"observed_at":"2026-08-08T17:46:33.274326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.822049Z","title":"Cascade r-cnn: Delv- ing into high quality object detection","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.822049Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:2a33b009b44fa8fa1d1c68ec1d000c7a8ea2421ef6ae6f62285de4f1c7b22209","observation_id":"a20c63e5-1b43-47d6-a0f0-347e18c1c2a2","resolution":{"observed_at":"2026-08-08T17:46:31.822049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.826385Z","title":"End-to- end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.826385Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:5cf842502879eaa626b60648e0efdc965155e13037602abebb4dab350c27ecc3","observation_id":"9acff370-abb3-4043-bb17-521b288d2967","resolution":{"observed_at":"2026-08-08T17:46:31.826385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.831066Z","title":"Spatialvlm: Endow- ing vision-language models with spatial reasoning capabili- ties","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.831066Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:3db3da4801374a0d20fe697dbd7003c8d0df5a462e2ce5a4ab84b62589746f77","observation_id":"97807a27-4df4-4431-916a-691441ae6081","resolution":{"observed_at":"2026-08-08T17:46:31.831066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.221773Z","title":"Vtqa: Visual text question answering via entity alignment and cross-media reasoning","venue":null,"work_id":"b3c06fbc-52c1-4634-9abb-65962bf4c09d","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.835442Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:d5cb6f4d34539e349e70d6f3f30e9be5ac16bb583db4f9d9ee6874f5b21a92b4","observation_id":"39798b91-80fe-437d-bdf8-ac20534339f5","resolution":{"observed_at":"2026-08-08T17:46:33.226687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.206567Z","title":"Yolo-world: Real-time open-vocabulary object detection","venue":null,"work_id":"da580c06-549f-4f35-bb9a-ff7c6f5fd2c9","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.839856Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:a05296b9401a441cc19a983fc5c5b6a5b042833640652781510917e7bd6a29a4","observation_id":"14702edc-7fb0-4c0c-8a41-2d096571b833","resolution":{"observed_at":"2026-08-08T17:46:33.211256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.844955Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.844955Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:3436064a267cf9cd216901c384706f0bb175074efde65eb27bbe678a3bb9c172","observation_id":"d97bb3cc-ba71-4cb8-8f3d-ba3ea2e526bd","resolution":{"observed_at":"2026-08-08T17:46:31.844955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-08T17:46:31.849072Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.849072Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:3cc1e5f17e3234c3b6852ff0bfaee25a9d946bc33d7002ac9fcbd2ece18d15ed","observation_id":"5a4d361e-e4b4-4579-a2ad-da3666951a81","resolution":{"observed_at":"2026-08-08T17:46:31.849072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.181245Z","title":"Flexible visual recognition by evidential modeling of confu- sion and ignorance","venue":null,"work_id":"5ff90123-f75a-45b6-8b41-a243423ced6c","year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.853693Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:0738f2631b5b0eedd4e9f2c1ab5fb3bd7a604993becd405eac61f14c01562033","observation_id":"5536f6a1-28b0-470d-947a-afe1d434326b","resolution":{"observed_at":"2026-08-08T17:46:33.186331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.165449Z","title":"Question aware vision transformer for multimodal reasoning","venue":null,"work_id":"6deeee47-ddcc-46e3-b201-ba3a59baa3f6","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.858289Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:e8470834d59d263ce5b3301e6c62915878644d85ad1e03db4c1ce31c7df00f37","observation_id":"b0ceaea6-64e7-41c9-a94a-181791af753d","resolution":{"observed_at":"2026-08-08T17:46:33.170742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.06088","last_updated":"2019-05-15T11:00:48Z","snapshot_observed_at":"2026-08-14T16:31:57.702360Z","submitted_at":"2019-05-15T11:00:48Z","title":"Neural-Symbolic Computing: An Effective Methodology for Principled Integration of Machine Learning and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.06088","snapshot_observed_at":"2026-08-08T17:46:31.863408Z","title":"Neural- symbolic computing: An effective methodology for princi- pled integration of machine learning and reasoning","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.863408Z"},"links":{"cited_paper":"/paper/1905.06088","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:206ef79ee51f74f94c9175a5001f6335aa2ea1374cfa2f01a0e73c8a73573cb2","observation_id":"c266c161-d6c4-4b28-989f-c174790b3a93","resolution":{"observed_at":"2026-08-08T17:46:31.863408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.149265Z","title":"Recurrent vision transformers for object detection with event cameras","venue":null,"work_id":"f914178b-712d-4d93-b199-85e6fc89cbed","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.868066Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:d3d6b91449728823228ddda29c93dfa55d58dffdf89f7add6b5310400c7d0dcf","observation_id":"1d500df5-c5df-4670-8ba6-283470f3af7d","resolution":{"observed_at":"2026-08-08T17:46:33.154011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.872033Z","title":"A background-agnostic framework with adversarial training for abnormal event detection in video","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.872033Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:a16d5f77610d65b4b1e1b7e282f49954c6b8a4c275405feeed875628fb3edd1d","observation_id":"da6ddc4e-77b7-4ebd-9ffe-deb566534177","resolution":{"observed_at":"2026-08-08T17:46:31.872033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.876427Z","title":"Fast r-cnn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.876427Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:d95ea727f2f4d59cdc3b4867ae2cd336b3a03ec4f33f092c42951afa50e66603","observation_id":"0fe105a3-8868-4423-b923-da76e75bed06","resolution":{"observed_at":"2026-08-08T17:46:31.876427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.880611Z","title":"Rich feature hierarchies for accurate object detection and semantic segmentation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.880611Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:008dde4c251bf72af43c9bd22dc0e9298b383f25b349b03737150d4c297b9f76","observation_id":"6bc94477-e37c-488c-a0a3-8d9e3cda01db","resolution":{"observed_at":"2026-08-08T17:46:31.880611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08532","last_updated":"2025-05-01T11:56:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-15T16:50:09Z","title":"EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08532","snapshot_observed_at":"2026-08-08T17:46:31.884612Z","title":"Connecting large language models with evolutionary algo- rithms yields powerful prompt optimizers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.884612Z"},"links":{"cited_paper":"/paper/2309.08532","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:92b4cab065e4268f1dacdec4ddfeeab14e0a36f0d4c8d0a9c546dcc98a9c5248","observation_id":"baecf3f3-b2e8-483e-9540-b5cab34f887f","resolution":{"observed_at":"2026-08-08T17:46:31.884612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.103937Z","title":"Ow-detr: Open-world detection transformer","venue":null,"work_id":"dcf838f8-b2d2-4c3d-8274-9e717d4506e0","year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.889020Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:b1ef6414bc7cc7cd65a8ef5da4697524c58663c8218fad81e99db1b2c0a6938e","observation_id":"81e8b8b4-faee-413f-a8b2-9dd8a3e82aad","resolution":{"observed_at":"2026-08-08T17:46:33.108633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11904","last_updated":"2024-02-19T09:24:44Z","snapshot_observed_at":"2026-08-13T08:36:34.116696Z","submitted_at":"2023-11-20T16:37:45Z","title":"LLMs as Visual Explainers: Advancing Image Classification with Evolving Visual Descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11904","snapshot_observed_at":"2026-08-08T17:46:31.893443Z","title":"Llms as visual explainers: Advancing image classification with evolving vi- sual descriptions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.893443Z"},"links":{"cited_paper":"/paper/2311.11904","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:6bcb6eda467d909c94eeeb9c4de41c9b350ce7efcfabfb6cd74464127ad36f27","observation_id":"b555193a-4808-4faa-9441-26365df35585","resolution":{"observed_at":"2026-08-08T17:46:31.893443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.087278Z","title":"Making anomalies more anomalous: Video anomaly detection using a novel generator and destroyer","venue":null,"work_id":"b97b4763-257d-4094-82cf-ab578ca78dbc","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.898457Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:66a40fc820420dc259d984a93809ecc363ebe8f7ecb9fbe05d892974c290e2c0","observation_id":"1359cf43-3e6a-41e1-9529-da9193cc1e03","resolution":{"observed_at":"2026-08-08T17:46:33.092472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-08T17:46:31.903227Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.903227Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:12a739677a428ee417c4b0af179ca1946dd15200733480b7c6bd6e7589268efe","observation_id":"e1b58041-80c2-4811-b4f5-210e6043acc4","resolution":{"observed_at":"2026-08-08T17:46:31.903227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.908308Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.908308Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:b74694813a9633373f66eb68cabdaf967b3d7a597a31c722c0e55f5d03ecba4f","observation_id":"deeabbc5-de32-4bba-96e6-fe9af63ffc5b","resolution":{"observed_at":"2026-08-08T17:46:31.908308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.060075Z","title":"Detrs with hybrid matching","venue":null,"work_id":"59fd9936-691a-454f-9529-5b69fe1781d7","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.912817Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:6bf700f8d160115d45c0a5093461c60eb00b480ecf41ee48c592b65972c82a8d","observation_id":"f3f4f2ab-6c6b-411c-bc3d-89ef5f400d13","resolution":{"observed_at":"2026-08-08T17:46:33.065836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.043518Z","title":"Consistency and uncertainty: Iden- tifying unreliable responses from black-box vision-language models for selective visual question answering","venue":null,"work_id":"85f027c5-d1f3-47c1-bfe9-2bbe427ca6fc","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.917716Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:b6979a09499a5bbdb2196ee11fbbf8b9cfc7bb3ce42edb703c3e24ab4c544645","observation_id":"0382f9d9-a092-4239-bb4e-2f83512b404c","resolution":{"observed_at":"2026-08-08T17:46:33.049152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.026979Z","title":"Visual genome: Connecting language and vision using crowdsourced dense image annotations","venue":null,"work_id":"7dcbcf3c-468d-4a68-a4b2-290591d6c3b0","year":2017},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.922661Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:d632d3cc5c469e4353d70df707c829f0f34589b496726f722d14a4576590d409","observation_id":"f6d80499-7a18-4fb1-978f-065aa7e98c5a","resolution":{"observed_at":"2026-08-08T17:46:33.032165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-08T17:46:31.927295Z","title":"The power of scale for parameter-efficient prompt tuning.arXiv preprint arXiv:2104.08691, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.927295Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:a0c33c3d8b1bfe30ea2d05cc9bd005d7746c7856b2f1a8deaaa6f98578f4acc8","observation_id":"1cc56625-b2ca-4249-81ad-013ed9c9eb4d","resolution":{"observed_at":"2026-08-08T17:46:31.927295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:33.010788Z","title":"Sodformer: Streaming object detection with transformer using events and frames","venue":null,"work_id":"286decf8-e8f3-4427-b377-e1f599d5bf4b","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.932429Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:f74c97d475f1c61cf822de09893ceea3f0e64d6a03295eb9001cfe9c701ff410","observation_id":"8e8791cd-4100-4634-b5af-64df8bb5ebb9","resolution":{"observed_at":"2026-08-08T17:46:33.016209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.995091Z","title":"Asynchronous spatio-temporal memory net- work for continuous event-based object detection","venue":null,"work_id":"8861dcbc-78c9-427c-b585-9153f3f8a0f7","year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.937252Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:91448830d3061a6b8615c0c9b754d148487b0b66407f5ee7ccec6cdd1a823e85","observation_id":"d6d8a686-ca77-4a87-b976-578bb9ed2595","resolution":{"observed_at":"2026-08-08T17:46:33.000162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.980145Z","title":"Neural- logic human-object interaction detection","venue":null,"work_id":"38cb0068-074e-4e66-abf6-872310528bf2","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.942455Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:b5dbb9fc7e48e45c8b4a25bbb0f730afe2200cb52dd2dd0e8a04dab6ba67a48b","observation_id":"89fefd25-e838-45fc-8922-6e2e35646f2a","resolution":{"observed_at":"2026-08-08T17:46:32.984664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.962369Z","title":"Grounded language-image pre-training","venue":null,"work_id":"ff90e329-bcf0-48c4-b024-99eff8cb385d","year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.947355Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:82cdb90a675805c5d160cb5d6e40c4801a0c8d81a14de723ff04d178b12b8fab","observation_id":"fb8ca9ad-fb88-44ff-b106-adf5d2afdc4b","resolution":{"observed_at":"2026-08-08T17:46:32.967979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.943878Z","title":"From pixels to graphs: Open-vocabulary scene graph generation with vision-language models","venue":null,"work_id":"c3e8400e-4ff7-42c6-966f-09c53f10e3fe","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.952353Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:0edd7f1cde37232b06fab0c3e3af92e9dc13a7bbb0ece3858f2de548c5db1e46","observation_id":"2de45993-f8d3-4d08-8703-c4049831320f","resolution":{"observed_at":"2026-08-08T17:46:32.949184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.927023Z","title":"Open-vocabulary semantic segmentation with mask-adapted clip","venue":null,"work_id":"81dc9d30-f340-4f6f-84b2-999086f854ec","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.957129Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:71ac76998853dd17dceb055a0ac413e795ad2b6feccf491d760137767f78232a","observation_id":"9d2c3474-5cd8-4658-aa14-f9021463b795","resolution":{"observed_at":"2026-08-08T17:46:32.931970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.909024Z","title":"Complex event recognition via spatial-temporal relation graph reasoning","venue":null,"work_id":"e2ea12bd-d487-45e0-a4e5-cf0620a944a3","year":2021},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.961732Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:624a50db6fd31f434d26e8b35514d15bf4103df493c51e0b396b835b184e35b8","observation_id":"504992f5-c0da-44f7-8317-efd4ac74cb82","resolution":{"observed_at":"2026-08-08T17:46:32.914336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.893230Z","title":"Ru-net: Regularized unrolling network for scene graph generation","venue":null,"work_id":"d5df6f79-ee69-455d-8919-74f1b893cf72","year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.966290Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:b23d7b18637dc8365e7643e1d78a34207fd23b1e6d3761be6d4f66b97f77afbd","observation_id":"4e1ec595-980a-4204-8ce5-9d15570e44d6","resolution":{"observed_at":"2026-08-08T17:46:32.898241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.876249Z","title":"Mo- tion robust high-speed light-weighted object detection with event camera","venue":null,"work_id":"df4b6915-b388-41ba-a7ad-79ffa5dd6467","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.971667Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:66bb067ea0d9e5b58963f926f881c507f0f665ea3098b98214c042b36de0ee1c","observation_id":"65679b6f-1570-46b5-971b-ed8a551639b5","resolution":{"observed_at":"2026-08-08T17:46:32.882105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.976639Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.976639Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:a735087b3521337965b3d4d59ed97c79bb6ca4285b8e8a711db9d23aa0a2ef86","observation_id":"a465ccf0-f01e-4284-a3db-779cfad02ecf","resolution":{"observed_at":"2026-08-08T17:46:31.976639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12329","last_updated":"2022-03-30T16:04:38Z","snapshot_observed_at":"2026-08-15T19:00:22.576928Z","submitted_at":"2022-01-28T18:51:09Z","title":"DAB-DETR: Dynamic Anchor Boxes are Better Queries for DETR","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12329","snapshot_observed_at":"2026-08-08T17:46:31.981613Z","title":"Dab-detr: Dynamic anchor boxes are better queries for detr","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.981613Z"},"links":{"cited_paper":"/paper/2201.12329","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:de4cf513d9952b3fbb609f6b2876041113f1f9100c477d31e345c8ffa5e7c938","observation_id":"f1c69f27-9e1a-45e2-8bca-07cf5d382e43","resolution":{"observed_at":"2026-08-08T17:46:31.981613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:31.986649Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.986649Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:5569e1b78c0b92b0d642c6b1716f2532e80275fbb83d4c83cf5894234cec2773","observation_id":"e0feb7e8-e64b-48df-9e1c-3affd609e1c1","resolution":{"observed_at":"2026-08-08T17:46:31.986649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.840022Z","title":"Diversity-measurable anomaly detection","venue":null,"work_id":"f7d24da4-02e7-4e81-ba98-ccf25fce209f","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.991432Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:c111e84f272dae2fd0fff34af3c768eb084fb41bb11a2f48f2de152156d93079","observation_id":"3a1f1b0d-141c-47cb-a4fc-eb416d55b620","resolution":{"observed_at":"2026-08-08T17:46:32.845147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.823781Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"d1b8ebb8-dfa7-4c00-875d-591db77b5ee2","year":2021},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.995496Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:bf2f6ef87bbcac45a7892a752aee00cdc310a89c3d01edd8cea4b9195cc53ffb","observation_id":"185e2313-cf0c-43e1-9084-6b6b5d0b3040","resolution":{"observed_at":"2026-08-08T17:46:32.828969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.808080Z","title":"Openeqa: Embodied question answering in the era of foun- dation models","venue":null,"work_id":"0cdee417-5c22-4129-9b18-683c7258c69d","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:31.999739Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:dedbc16bb0388b8a048125d2ea7fb17434566635c6b5eb913acf604978f06f1e","observation_id":"8df4cb66-be10-4a37-acb5-d66dbe9840ef","resolution":{"observed_at":"2026-08-08T17:46:32.813183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12584","last_updated":"2019-04-26T06:50:54Z","snapshot_observed_at":"2026-08-14T16:41:07.492381Z","submitted_at":"2019-04-26T06:50:54Z","title":"The Neuro-Symbolic Concept Learner: Interpreting Scenes, Words, and Sentences From Natural Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12584","snapshot_observed_at":"2026-08-08T17:46:32.004027Z","title":"The neuro-symbolic concept learner: Interpreting scenes, words, and sentences from nat- ural supervision","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.004027Z"},"links":{"cited_paper":"/paper/1904.12584","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:004fe5fc54034334ca6e2430f0d4cb7bec078227b16fc02dfdd1ebe0c5f9291f","observation_id":"8f32694f-28aa-4e56-ac1f-45821422df68","resolution":{"observed_at":"2026-08-08T17:46:32.004027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.009007Z","title":"Conditional detr for fast training convergence","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.009007Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:a65934eb29d0022a36f104093b1986a59eae445c2611f6e8596b4db49805d9ad","observation_id":"0542b719-aa28-4048-98d1-8e4a1cc90fba","resolution":{"observed_at":"2026-08-08T17:46:32.009007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.781917Z","title":"Automatic interaction and activity recog- nition from videos of human manual demonstrations with application to anomaly detection","venue":null,"work_id":"81402eb5-79c2-44b3-9200-790723fd9593","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.013111Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:e934c5bf45a1283dda92bb4821aa15e0b18901598329af4a30d6b686c42bfb3e","observation_id":"cd5f2e1d-09eb-4b70-9f8a-75b3cf6ffb72","resolution":{"observed_at":"2026-08-08T17:46:32.787183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.765441Z","title":null,"venue":null,"work_id":"f854760b-d516-421f-9c6b-f1b8ea48929c","year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.017222Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:bfebcf4157c64f73dba6142733b3b1303a67a4333d9c63b73d28bfad49a90ed3","observation_id":"f111fbef-d529-4d38-b9b5-b456601e5621","resolution":{"observed_at":"2026-08-08T17:46:32.770459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-08T17:46:32.021720Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.021720Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:a13f2b77ee44c7244f844379d469e2c7a7bbd2939d1cd010b5ab5eafa233c3a5","observation_id":"164129ef-f4df-4b2a-a2a0-13512c8966fa","resolution":{"observed_at":"2026-08-08T17:46:32.021720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08364","last_updated":"2024-06-30T09:50:11Z","snapshot_observed_at":"2026-08-13T05:25:24.437955Z","submitted_at":"2023-11-14T18:14:56Z","title":"Plum: Prompt Learning using Metaheuristic","version":3},"cited_work":{"arxiv_id":"2311.08364","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.08364","snapshot_observed_at":"2026-08-08T17:46:32.274407Z","title":"Plum: Prompt Learning using Metaheuristic","venue":"cs.LG","work_id":"a3a70439-937b-443a-8792-04c78c4c180f","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.026103Z"},"links":{"cited_paper":"/paper/2311.08364","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:6bd776c441b907125fdad37441ab9b1607dc822269df449dd2506ab4845c6d33","observation_id":"3b5f88ef-7305-4ce3-a473-f6df87feb4e5","resolution":{"observed_at":"2026-08-08T17:46:32.281008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.749744Z","title":"Fastano: Fast anomaly detection via spatio- temporal patch transformation","venue":null,"work_id":"3fde5e5f-1fc3-4363-b1de-83d68f8ac235","year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.030992Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:2e180d9fc6269c6d05216e3b7abafbf33d769263f0263fc5701f5475d235a576","observation_id":"232ad9f8-81bb-4494-84c0-63fe8faa9980","resolution":{"observed_at":"2026-08-08T17:46:32.755110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14167","last_updated":"2023-05-24T02:51:37Z","snapshot_observed_at":"2026-08-13T11:35:26.490733Z","submitted_at":"2023-05-23T15:37:28Z","title":"DetGPT: Detect What You Need via Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14167","snapshot_observed_at":"2026-08-08T17:46:32.035923Z","title":"Detgpt: Detect what you need via reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.035923Z"},"links":{"cited_paper":"/paper/2305.14167","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:325f28b172fa70bef3aa634a1807cd52fad3c7c2c493503cb46b00164dc2d415","observation_id":"f697885c-f8e1-4f19-b77f-9c5f688a0203","resolution":{"observed_at":"2026-08-08T17:46:32.035923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.040815Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.040815Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:7da1bf7065bf43a530e0fc7b13882fb217adf4a3ee59ce749576eda921f3fc73","observation_id":"4024bfef-56c4-422b-ab9e-70e14f043c18","resolution":{"observed_at":"2026-08-08T17:46:32.040815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.045893Z","title":"You only look once: Unified, real-time object de- tection","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.045893Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:55902d3b25ee7bf2e9bbd6c88efeec84ef34fb0213d43c8c907c30c93202d1c1","observation_id":"4e9b88e5-260a-4aab-81cb-dbefe287530b","resolution":{"observed_at":"2026-08-08T17:46:32.045893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.051369Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.051369Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:06134f7b9cb7fb14a5cac0e9a4022e53d30fbc2fdb8bca6d007bfa9a9e8681e3","observation_id":"aff6ac5e-029f-4772-b777-bbb697854f68","resolution":{"observed_at":"2026-08-08T17:46:32.051369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.703012Z","title":"Self-distilled masked auto-encoders are efficient video anomaly detectors","venue":null,"work_id":"1abec504-d443-4d07-9755-4e7a9622138a","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.056498Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:d403458f82951c733bbc5387dd0eb7a77a0a7be3dcee269f1d1e01ff61ccb416","observation_id":"b1a9be3b-495f-49cf-9be2-5320538eeb41","resolution":{"observed_at":"2026-08-08T17:46:32.708004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.061353Z","title":"Learning to detect every thing in an open world","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.061353Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:49b4396d699019626801a2048c72d9fe7bfdffda4a5372a0a153794dea379f0f","observation_id":"f91921ed-e4f4-487c-81ed-c064b345dac8","resolution":{"observed_at":"2026-08-08T17:46:32.061353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.677193Z","title":"Deepunseen: Unpredicted event recognition through integrated vision- language models","venue":null,"work_id":"e919a672-99a0-4977-8470-2a4370ffda03","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.066694Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:17353e65e08c5c79a3aa8e3509a3e8daad960a4a6ced973a2229628855d5ffc7","observation_id":"66ab49bf-a9df-4327-8de0-b40c20fc94cd","resolution":{"observed_at":"2026-08-08T17:46:32.682148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.661092Z","title":"Aligning and prompting everything all at once for univer- sal visual perception","venue":null,"work_id":"d96745f4-0e58-462b-a69c-37a7376846e2","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.071466Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:55fcd9ee025de42f1f066e54da5da11eb84b77d1f9d6fa37b203b5f9a7c4f253","observation_id":"15fb48cb-a035-444d-a55a-99d92b79dee5","resolution":{"observed_at":"2026-08-08T17:46:32.666328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.645894Z","title":"Explainable and explicit visual reasoning over scene graphs","venue":null,"work_id":"b687db64-9b5f-4a0a-9bea-05e305622d19","year":2019},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.076226Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:33b07f6e9e1daf6d99d8ea73f494186479f84346429374575e1efd7c71f93571","observation_id":"be46e15c-52bb-4f8b-8f11-cf851653bade","resolution":{"observed_at":"2026-08-08T17:46:32.650337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.630394Z","title":"Vald-gan: video anomaly detection using latent discriminator augmented gan","venue":null,"work_id":"8ca99adc-9a98-4baa-bffa-aa6edd52041d","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.081019Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:0fb6350e66f26e8d27bd3905e1af61fbd0261ca7b1394b5e4f5f045c5cdf8363","observation_id":"fb46756d-867a-4362-b4b7-5d9499b607fd","resolution":{"observed_at":"2026-08-08T17:46:32.635041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-08-15T01:20:03.559618Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-08T17:46:32.086141Z","title":"Eva-clip: Improved training techniques for clip at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.086141Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:11d586dbd90df0e82ec60ca27ea8344ca0a4e4bbe1bc4bba086b43c218e39810","observation_id":"d54ac4be-b9e6-4309-a549-6820ca24bf76","resolution":{"observed_at":"2026-08-08T17:46:32.086141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.615394Z","title":"Dual memory aggregation network for event-based ob- ject detection with learnable representation","venue":null,"work_id":"df2bc563-104e-4536-bb30-d58e7691a4b2","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.091261Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:5d5816381df597f689168ea1d168e7c19fdac1fdacc4449c363c70903d534fc2","observation_id":"d4db15d5-2426-445f-b449-c550805f2c9e","resolution":{"observed_at":"2026-08-08T17:46:32.620449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.600072Z","title":"Anomaly detection in crowd scene","venue":null,"work_id":"b3a04ecf-8ebe-4324-8b8a-7f6efde705f3","year":2010},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.096097Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:27c6a2ad3245ff844fc8f039c2f475686fc24c73bfa6963c300b6e284cb2aa29","observation_id":"989e40dc-d6fc-4e87-a9ca-559503d70175","resolution":{"observed_at":"2026-08-08T17:46:32.605069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.584339Z","title":"Scene graph disentanglement and composition for generalizable complex image generation","venue":null,"work_id":"26946ddc-9be5-4f26-8d86-a12f43cbc2db","year":2025},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.100866Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:ec2304cc3cd14346ae7de600a9ee2de2f4c26bc34dfb859af9be7fbe002acb36","observation_id":"35471eaa-7981-41d4-8539-3356b6f86948","resolution":{"observed_at":"2026-08-08T17:46:32.589395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17041","last_updated":"2022-10-31T03:36:21Z","snapshot_observed_at":"2026-08-13T13:53:28.174754Z","submitted_at":"2022-10-31T03:36:21Z","title":"GPS: Genetic Prompt Search for Efficient Few-shot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17041","snapshot_observed_at":"2026-08-08T17:46:32.105889Z","title":"Gps: Genetic prompt search for efficient few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.105889Z"},"links":{"cited_paper":"/paper/2210.17041","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:e9d619ca69c3db751ce1acc88a865a4fa481a4166ab1188c979a0f0c0e47b780","observation_id":"8feff77f-1f92-477c-8a36-f43baf875965","resolution":{"observed_at":"2026-08-08T17:46:32.105889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.567463Z","title":"Neural-symbolic vqa: Disentangling reasoning from vision and language under- standing","venue":null,"work_id":"d362e2dc-e978-4c1d-97f7-b632739ad6fe","year":2018},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.111061Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:bc5f8e0411076f68ea8ddc079634d0c765123b86e09b9a74213971c7437c8047","observation_id":"0af5ff56-148b-419f-8e9a-a7de45193768","resolution":{"observed_at":"2026-08-08T17:46:32.573039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.551314Z","title":"Bridging knowledge graphs to generate scene graphs","venue":null,"work_id":"f439f59b-0e1f-427d-95d1-9c9b13186eab","year":2020},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.115696Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:f4a32f3058d67efbbdf5d867079bf75333dc2e4e3ce7aa2de2c8fa049e45d08f","observation_id":"1f0c0d79-fc27-4dda-b714-a702e4bf06b0","resolution":{"observed_at":"2026-08-08T17:46:32.556935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-07T03:38:32.486362Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-08-08T17:46:32.120340Z","title":"Dino: Detr with improved denoising anchor boxes for end-to-end object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.120340Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:4948fcb4b43736ff073ab6e60fe10edd8c8ebef0b3d8636a4c82f6a3446b36a6","observation_id":"bd4c49f0-1633-4143-b25c-111de8daa408","resolution":{"observed_at":"2026-08-08T17:46:32.120340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.534499Z","title":"Spiking transform- ers for event-based single object tracking","venue":null,"work_id":"ebe1cc0e-6117-4d0a-8961-9e468ae62310","year":2022},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.125491Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:c3eee9e87944be5e7de5c2167dd6a8f7ff765bc6f50b60fcf80177a4616fe97d","observation_id":"f3be8a1c-c165-4a18-aa96-e6cca01e6e58","resolution":{"observed_at":"2026-08-08T17:46:32.540021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.518580Z","title":"Groundhog: Grounding large language models to holistic segmentation","venue":null,"work_id":"0877492f-8ee3-477f-b6f9-dcedfb245ba7","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.129978Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:453fb632621279bf0b73cf9f8d59fcb060efcbfa2f23989e34fd141b37892d8c","observation_id":"50a7cf3b-6cdc-4765-a6ed-83ebc6e2ffcd","resolution":{"observed_at":"2026-08-08T17:46:32.523707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-08T17:46:32.134732Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.134732Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:8aa8785c10cef572a9f41de750cf4c2f7f959c8e82e5b4eed58686e81dce3ef6","observation_id":"77afa86b-1935-4e89-a63a-76304192989f","resolution":{"observed_at":"2026-08-08T17:46:32.134732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.501572Z","title":"Prob: Probabilistic objectness for open world object detection","venue":null,"work_id":"ffb7e444-099e-4ca3-a7aa-664fe0484853","year":2023},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.139659Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:44f490665120cc9bce8e096e408808c85a7cfde3ac849ac177515956af51fea8","observation_id":"30e0f227-b3d6-46eb-8523-c4b558a10841","resolution":{"observed_at":"2026-08-08T17:46:32.506828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.484828Z","title":"Segment everything everywhere all at once","venue":null,"work_id":"4b2a8aa3-2f88-4841-b598-2e8650789537","year":2024},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.143909Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:7eea2daa202ed762767e6c812d652b97417b712e22ee28024607d10dcce3c4c4","observation_id":"76e9cef3-d756-465e-bfba-e6cc02a4de36","resolution":{"observed_at":"2026-08-08T17:46:32.489986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.470321Z","title":null,"venue":null,"work_id":"7ba21588-0f71-4b80-b9c2-33080a4b0b43","year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.148351Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:1d5c8baa22705ee926031a2dc27fcdf817e177c89f6cf99af1fc5edb4064326c","observation_id":"5e6cd128-e065-40cd-901e-2ce6cce5aa8b","resolution":{"observed_at":"2026-08-08T17:46:32.474791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.455257Z","title":"Detailed results can be found in Table 4","venue":null,"work_id":"a13d795f-fc18-4c4e-9024-173de6aed4fa","year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.152716Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:9e934b9b862d3c7b896d4dfd010260b8380000430b143048368fa9170508e666","observation_id":"501e2a89-e2b6-4cfe-85d0-3b9b86645558","resolution":{"observed_at":"2026-08-08T17:46:32.460173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:46:32.432869Z","title":"Table 8 summarizes the key mathematical symbols and their definitions used in this work","venue":null,"work_id":"658eedf8-0205-438d-b076-f686d6f5a9b4","year":null},"citing_paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T17:46:32.156707Z"},"links":{"citing_paper":"/paper/2502.05843"},"observation_digest":"sha256:149e361c2fdfe4e5f1fbed8b72950b66f6cb81fef1924815d7cb7a6fcf2cb1ac","observation_id":"06230eff-3170-40a6-8a98-571e6a722afa","resolution":{"observed_at":"2026-08-08T17:46:32.443468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.05843","last_updated":"2025-07-16T11:47:45Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T06:57:53.656930Z","submitted_at":"2025-02-09T10:30:54Z","title":"From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":41},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 1 inbound Pith citation observation for arXiv:2502.05843."}