{"as_of":"2026-08-21T05:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22d849e636641f7dd46c3f7cfc46e2be3a03840ad660a642d0a9d62dca4bbabc","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:29:19.607156Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:52:56.262993Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:19:57.744872Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17767","snapshot_observed_at":"2026-08-15T20:52:56.262993Z","title":"Exploring aleatoric uncertainty in object detection via vision foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11804","last_updated":"2025-05-17T03:16:49Z","snapshot_observed_at":"2026-08-18T02:15:47.530924Z","submitted_at":"2025-05-17T03:16:49Z","title":"Are vision language models robust to uncertain inputs?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:52:56.262993Z"},"links":{"cited_paper":"/paper/2411.17767","citing_paper":"/paper/2505.11804"},"observation_digest":"sha256:b04ebf2aa554122aada1445b5121167c1d63577b38aebd93abc5e8edd9b01860","observation_id":"78f2582b-d383-4c68-959b-63e97d64830b","resolution":{"observed_at":"2026-08-15T20:52:56.262993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"cited_work":{"arxiv_id":"2411.17767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17767","snapshot_observed_at":"2026-07-04T16:19:57.744872Z","title":"Exploring aleatoric uncertainty in ob- ject detection via vision foundation models","venue":null,"work_id":"505a5e23-5b33-49a9-aa51-48bef92fc6d7","year":2024},"citing_paper":{"arxiv_id":"2604.10963","last_updated":"2026-04-13T03:59:54Z","snapshot_observed_at":"2026-07-06T22:59:27.499664Z","submitted_at":"2026-04-13T03:59:54Z","title":"Delving Aleatoric Uncertainty in Medical Image Segmentation via Vision Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:25:38.430882Z"},"links":{"cited_paper":"/paper/2411.17767","citing_paper":"/paper/2604.10963"},"observation_digest":"sha256:06f47f7193ebb69c509ea24633be2d90ba5983de9f21b0dc16fd2cf757e86423","observation_id":"14b252fc-9f69-4893-a4ee-897d87503ae1","resolution":{"observed_at":"2026-05-11T08:56:00.254346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"cited_work":{"arxiv_id":"2411.17767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17767","snapshot_observed_at":"2026-07-04T16:19:57.744872Z","title":"Exploring aleatoric uncertainty in ob- ject detection via vision foundation models","venue":null,"work_id":"505a5e23-5b33-49a9-aa51-48bef92fc6d7","year":2024},"citing_paper":{"arxiv_id":"2606.24539","last_updated":"2026-06-23T13:06:51Z","snapshot_observed_at":"2026-08-02T12:19:25.025255Z","submitted_at":"2026-06-23T13:06:51Z","title":"PointVG-R: Internalizing Geometric Reasoning in MLLMs for Precise Pointing Localization via Visual Chain of Thought","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T00:46:17.094339Z"},"links":{"cited_paper":"/paper/2411.17767","citing_paper":"/paper/2606.24539"},"observation_digest":"sha256:c870231963dc3b78cd41f19f917f19355de1144d7c9ab101705cdb566eb5fd73","observation_id":"900b8d08-ad12-4449-8194-a097879fc0e7","resolution":{"observed_at":"2026-07-04T16:19:57.746857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.17767/citation-record","integrity":"/paper/2411.17767/integrity","json":"/paper/2411.17767/citation-record.json","paper":"/paper/2411.17767"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.10724","last_updated":"2023-05-18T05:52:06Z","snapshot_observed_at":"2026-08-20T15:40:46.425055Z","submitted_at":"2023-05-18T05:52:06Z","title":"Segment Any Anomaly without Training via Hybrid Prompt Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10724","snapshot_observed_at":"2026-08-12T12:29:19.429823Z","title":"Segment any anomaly without training via hybrid prompt regularization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.429823Z"},"links":{"cited_paper":"/paper/2305.10724","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:48b69a08475e6261a61ab536ca72d7a6eb8dbc874ccdfc44b909a1d0acf2b06c","observation_id":"52a95491-c158-4d6e-a5b4-df770b86a88f","resolution":{"observed_at":"2026-08-12T12:29:19.429823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.093961Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"3f2e3976-3959-4aa5-bb68-d46f7ae5edd9","year":2020},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.433681Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:d096dc6f3b751661eeb075ff89024172c366881178cc4c6dfe76359a7d271872","observation_id":"17f7ecd5-1a0a-4944-85bd-a714b98f0aeb","resolution":{"observed_at":"2026-08-12T12:29:20.097651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.084304Z","title":"Data uncertainty learning in face recognition","venue":null,"work_id":"cb3aa296-1de4-48f5-af60-15f2f4896490","year":2020},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.437033Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:3bd5a0d382358226a0363ead190b477fec870b58537904a9841ca31232e6e9bb","observation_id":"19126069-877b-4920-9619-0c516c3f3f7e","resolution":{"observed_at":"2026-08-12T12:29:20.088068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.073944Z","title":"Confidence- based reliable learning under dual noises","venue":null,"work_id":"9cd052ba-005f-4c7d-bd1f-4c4ef4a3c975","year":2022},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.441298Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:bc7639c8601cc1b0da055dcb0867f1833cdb7024cf71a6e75038872adcbb20fd","observation_id":"b783644e-434b-4d27-b0c3-6c6aa05a4f30","resolution":{"observed_at":"2026-08-12T12:29:20.077764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.063091Z","title":"Learning sample difficulty from pre-trained models for reliable prediction","venue":null,"work_id":"87c8a628-bfb6-46e6-b204-83899cf68f9b","year":2024},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.445703Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:2a927a65b50cc10fad96e86a54bad49b35b1973bd50aaa5e31b24b1b49f73a13","observation_id":"38bd727e-9fbd-4168-b2bf-042efad2f9d8","resolution":{"observed_at":"2026-08-12T12:29:20.067586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.054504Z","title":"Decomposition of uncer- tainty in bayesian deep learning for efficient and risk-sensitive learning","venue":null,"work_id":"d03db1a9-1b75-49a7-9f03-a78022f48b45","year":2018},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.448746Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:26d7e213012bbd6b7d4adfb630398863fcead446963f75b076b7f38a74e377f2","observation_id":"33722fe9-2f77-4e44-9e79-c71e14c3c542","resolution":{"observed_at":"2026-08-12T12:29:20.057632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.044895Z","title":"Aleatory or epis- temic? does it matter? Structural safety, 31(2):105–112,","venue":null,"work_id":"3c07f66d-bbd3-459b-b3fb-a86b77adfadd","year":null},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.453062Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:ad3f2671d69ed9eeb5d79626709dd9255ad484c8e595316a241139aa57c3b824","observation_id":"17941345-7a04-43c8-85b1-aeed0adc38e7","resolution":{"observed_at":"2026-08-12T12:29:20.047996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.035170Z","title":"Dietterich and Alex Guyer","venue":null,"work_id":"c0d49ceb-fc95-4f1e-bc7c-3d270bd35bb8","year":2022},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.456814Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:13993f6e312db2d2440f5311bf3307e868f59a22138d383e51ab80d010df95af","observation_id":"0f5f05a1-fbbf-4ec2-9f14-e46be1d6ff54","resolution":{"observed_at":"2026-08-12T12:29:20.038901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.026004Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"e459e32b-f8fd-4069-b134-0941596f2316","year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.459738Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:3e39de75721f4f565fd5b1753b10e64b28d3d81d76462a2b372681b2a5950005","observation_id":"dec687e1-75e0-490e-bda0-383b826d4875","resolution":{"observed_at":"2026-08-12T12:29:20.029488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.017179Z","title":"Everingham, S","venue":null,"work_id":"501e9163-6a4a-4aa0-acb2-68add19f727d","year":2015},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.462575Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:50b05eba4ffa9213794274efe3b3888a2a276972a9c7b66f3fc57f11b5554c0a","observation_id":"7000785c-0d3b-4422-b287-8445680385d8","resolution":{"observed_at":"2026-08-12T12:29:20.020149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:20.008305Z","title":"Dropout as a Bayesian approximation: Representing model uncertainty in deep learn- ing","venue":null,"work_id":"b748a3e4-b309-4c67-bb5c-ece0771906b9","year":2016},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.465423Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:08b38c2758449e80fcefe57b2040e07877e4d7ec2b6e5ef2c2850543a1a24ac9","observation_id":"a2a6b4d6-f2e0-4ca3-b113-c27ef802bad1","resolution":{"observed_at":"2026-08-12T12:29:20.011566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08430","last_updated":"2021-08-06T03:22:14Z","snapshot_observed_at":"2026-08-19T15:19:25.831687Z","submitted_at":"2021-07-18T12:55:11Z","title":"YOLOX: Exceeding YOLO Series in 2021","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.08430","snapshot_observed_at":"2026-08-12T12:29:19.469034Z","title":"Yolox: Exceeding yolo series in 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.469034Z"},"links":{"cited_paper":"/paper/2107.08430","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:14debedc91cad3926a8ff174c09b749b520d5393e7e762c1ed5ef88af87cc102","observation_id":"b2441157-a79c-4610-b873-12c5a8ccb51f","resolution":{"observed_at":"2026-08-12T12:29:19.469034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.472392Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.472392Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:d06ef3d4b1f24bf5e60a4a1f935b0b30abf869b8982559abee954307e783a8b4","observation_id":"7094b930-2344-4c76-bb75-e738737ebcdb","resolution":{"observed_at":"2026-08-12T12:29:19.472392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.475978Z","title":"Mask r-cnn","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.475978Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:7768c12b7875d61cfaf32a08eb9fdba99c691ce803bcfa30c08d7c997da07b04","observation_id":"240f9698-767a-491b-9b18-c9c8b178d297","resolution":{"observed_at":"2026-08-12T12:29:19.475978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.989328Z","title":"Open-set image tagging with multi-grained text supervision","venue":null,"work_id":"e7298ce3-bd1e-4929-b768-ba5560dcb015","year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.478773Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:58cb05f1c5e02064cf22812be39647d6dc7d92e6eed04dc09ea051acf6620a80","observation_id":"290e92e0-b30f-44e7-8c6b-c1822ac41324","resolution":{"observed_at":"2026-08-12T12:29:19.992450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05657","last_updated":"2024-03-18T12:34:30Z","snapshot_observed_at":"2026-08-16T15:49:20.977075Z","submitted_at":"2023-03-10T02:16:35Z","title":"Tag2Text: Guiding Vision-Language Model via Image Tagging","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05657","snapshot_observed_at":"2026-08-12T12:29:19.481667Z","title":"Tag2text: Guiding vision-language model via image tagging","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.481667Z"},"links":{"cited_paper":"/paper/2303.05657","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:4aafd1e97ee58091f49e4e62f99eefad6442a0a6d560e3020a62929b5573e3d1","observation_id":"5458b101-cb05-4f45-9869-7f477235f072","resolution":{"observed_at":"2026-08-12T12:29:19.481667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.980733Z","title":"Aleatoric and epistemic uncertainty in machine learning: an introduction to concepts and methods","venue":null,"work_id":"7f1b2379-59e5-4ec1-8a9d-829187cec2e8","year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.485822Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:922e7dc7a510826fa6bd2dbb06ccde9b6d886c0457c5733a60bdd62d7bb6795b","observation_id":"2efecd3c-caf2-4ad2-ae1f-0f33e2d5c1fe","resolution":{"observed_at":"2026-08-12T12:29:19.983748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.971187Z","title":"What uncertainties do we need in bayesian deep learning for computer vision? In Advances in Neural Information Processing Systems","venue":null,"work_id":"f60f7288-751a-46d8-930b-395950a3c3af","year":2017},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.488585Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:cb96cd3116edb81fddda0377df9a6cdc90cc2aa0589ab08f0d500376e0d7e82f","observation_id":"799d29c2-9b33-471e-8d71-3b8344970c5c","resolution":{"observed_at":"2026-08-12T12:29:19.974896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.961659Z","title":"Why normalizing flows fail to detect out-of-distribution data","venue":null,"work_id":"88083e14-1b4e-45b9-b189-e1ee7aa69590","year":2020},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.491457Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:23fc821355302ec66cefbdf37bc127f7d77ada51654065aa172b667132c8e49f","observation_id":"7e7d3866-271c-4a92-9f59-6914ebd41c4a","resolution":{"observed_at":"2026-08-12T12:29:19.965026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.494615Z","title":"Berg, Wan-Yen Lo, Piotr Dollar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.494615Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:9b2b5f85d7b8379d5a0cb9db7b7d108707a43012a08a2d0ac3e69c5e81cc883a","observation_id":"9cc8ed3e-2647-4889-a17a-05921e981893","resolution":{"observed_at":"2026-08-12T12:29:19.494615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.948071Z","title":"Blip: Bootstrapping language-image pre-training for unified vision- language understanding and generation","venue":null,"work_id":"981e351c-9e59-4cc1-bbe9-9d8ba9192f88","year":2022},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.497492Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:36e5473324fb5cd17ab52be1bf407550a1d9d700770464c0b1b8fc4b66a1b6bc","observation_id":"bd0c9f72-ee8c-4039-81fc-63aaf78e2092","resolution":{"observed_at":"2026-08-12T12:29:19.951070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.938940Z","title":"BLIP- 2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"73d74c13-93e0-460b-aaf1-1e1f5caf1925","year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.500181Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:9c0c8891bb9fb824b6ed2cd1ca986ce38bec628f53d638aff268542688408ca7","observation_id":"44c6665c-bf0b-44e3-b89f-c58236b6ed9c","resolution":{"observed_at":"2026-08-12T12:29:19.942053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.929294Z","title":"Clipsam: Clip and sam collaboration for zero-shot anomaly segmentation, 2024","venue":null,"work_id":"69493fa8-f4ce-443b-99bc-7ed396ceb092","year":2024},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.502836Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:a597510067a5bcbc188e75af7caa0475453b2ee9e51f0d8ccde59d2faf8c5b3d","observation_id":"43d97bb2-30e8-47f9-ba20-ac10626fa806","resolution":{"observed_at":"2026-08-12T12:29:19.933179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.505461Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.505461Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:a090878323341cd4ed710f852070ce938328b9bdb8bb197428473c73580caee5","observation_id":"d8737f04-f928-4e03-ae33-d7fd4ac77ce3","resolution":{"observed_at":"2026-08-12T12:29:19.505461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.915488Z","title":"Gmm- seg: Gaussian mixture based generative semantic segmenta- tion models","venue":null,"work_id":"8f5aef01-28b0-4c01-b038-73bcb2e00e21","year":2022},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.508631Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:586693655a96e52d7f85bfc407f92fb3a0c8142b52a5202e60a7b04d3e289187","observation_id":"b623127a-c1ba-4595-a418-7c03ac19babf","resolution":{"observed_at":"2026-08-12T12:29:19.918558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.905594Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"316e3d5c-b725-47de-8ece-aedeb1d7d1b4","year":2014},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.512091Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:3fe721f27e09f8d27b14a9bf52058787750129b831871a85f868ecc699122406","observation_id":"12f0af10-3171-434c-91c9-89a6807beda8","resolution":{"observed_at":"2026-08-12T12:29:19.909703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.895557Z","title":"Focal loss for dense object detection","venue":null,"work_id":"2fbaa8a2-1dd7-4910-a1af-709d57f73375","year":2017},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.515517Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:9aaf2024bed07be41209cce6f9790fb08faec9e289803c0e026a1f939ca2795b","observation_id":"cef863ee-fd06-46cc-b797-ca80e04eac60","resolution":{"observed_at":"2026-08-12T12:29:19.899124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14566","last_updated":"2024-03-25T06:05:24Z","snapshot_observed_at":"2026-08-19T10:24:15.607193Z","submitted_at":"2023-10-23T04:49:09Z","title":"HallusionBench: An Advanced Diagnostic Suite for Entangled Language Hallucination and Visual Illusion in Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14566","snapshot_observed_at":"2026-08-12T12:29:19.518669Z","title":"Hallusionbench: You see what you think? or you think what you see? an image-context reasoning benchmark challenging for gpt-4v (ision), llava-1.5, and other multi-modality models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.518669Z"},"links":{"cited_paper":"/paper/2310.14566","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:317e41911097881db1dace7c6eec8aef40bae2ac2ec1c8ff9449ae066f95f26d","observation_id":"215f1a4b-3702-43ec-b238-929cba0236e6","resolution":{"observed_at":"2026-08-12T12:29:19.518669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.521968Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.521968Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:0f65a85bd768b849dffb1a226f0bf9d60ebfa3d0f0d1d2ba67c8da6a8b4f0507","observation_id":"2828f78e-e9f8-487d-a303-a01793700f74","resolution":{"observed_at":"2026-08-12T12:29:19.521968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-08-19T16:02:58.628969Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-12T12:29:19.525040Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.525040Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:b1d33e8ad8814c37f2ff3f8715539019909c6710c1e594042b967c67472ff356","observation_id":"b024e5c9-06e2-4aec-bf09-1d6f59ab1e51","resolution":{"observed_at":"2026-08-12T12:29:19.525040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.880710Z","title":"Towards robust adaptive object detection under noisy annotations","venue":null,"work_id":"825d3a07-1219-4e71-919c-a8283cfe50a4","year":null},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.527982Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:0c9dd9e5369ddf3354133b1352defbf9c8d28ea9eff7eab362b81111da30e6cb","observation_id":"724570bd-fb47-4163-8208-00b123f24e60","resolution":{"observed_at":"2026-08-12T12:29:19.884688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.530813Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.530813Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:a0be5bc92709b27aabfb076b3d242e3845cd72543d9f864b918c261cd892b878","observation_id":"b139c542-c8bd-45a1-9848-3d1fa5de9d2a","resolution":{"observed_at":"2026-08-12T12:29:19.530813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.865851Z","title":"Calibrating deep neural networks using focal loss","venue":null,"work_id":"c4241884-7b9a-4eeb-9e1d-4cecde7e2864","year":2020},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.533917Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:c8529c15d17935723812c8327bbb077afafaf22f52cc0b2e626e70e9137e3856","observation_id":"ff189c6c-7fd7-473d-8d93-e9a9809124b1","resolution":{"observed_at":"2026-08-12T12:29:19.869065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.857491Z","title":"Deep deterministic uncertainty: A new simple baseline","venue":null,"work_id":"a247ef48-c619-4a43-982d-1a5ca7d08f66","year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.537179Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:0b084253381af476f9cd96044cc917e9fa9d3d4c63507bcfb8711bf156608e5d","observation_id":"c7c52caf-f10a-46ab-8901-3bd1708d3b44","resolution":{"observed_at":"2026-08-12T12:29:19.860551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.539963Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.539963Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:1127bbfca29f91cbddba5b0c70ed9e8cf8bbc957bd2ed21810741194258837ed","observation_id":"af4c9b97-6c93-43c8-89ad-d747ab7905ce","resolution":{"observed_at":"2026-08-12T12:29:19.539963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06548","last_updated":"2017-01-23T18:35:28Z","snapshot_observed_at":"2026-08-14T21:19:55.038511Z","submitted_at":"2017-01-23T18:35:28Z","title":"Regularizing Neural Networks by Penalizing Confident Output Distributions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06548","snapshot_observed_at":"2026-08-12T12:29:19.543082Z","title":"Regularizing neural networks by penalizing confident output distributions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.543082Z"},"links":{"cited_paper":"/paper/1701.06548","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:3ebb7fe2df1b9e8a62612f2725db8006a6cb2d88714d4b268e78e4ce7cebb244","observation_id":"13968c0b-a4b9-4272-b4de-d635127e985d","resolution":{"observed_at":"2026-08-12T12:29:19.543082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.546305Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.546305Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:88f03cd2cb301e36f4ff05bbf2780c0e1f8a5ffa6ee3d7b2988751d512b46d1c","observation_id":"ec68e178-ff2d-41ab-966e-9dd2b223e880","resolution":{"observed_at":"2026-08-12T12:29:19.546305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02767","last_updated":"2018-04-08T22:27:57Z","snapshot_observed_at":"2026-08-15T16:54:48.034047Z","submitted_at":"2018-04-08T22:27:57Z","title":"YOLOv3: An Incremental Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02767","snapshot_observed_at":"2026-08-12T12:29:19.549093Z","title":"Yolov3: An incremental improvement","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.549093Z"},"links":{"cited_paper":"/paper/1804.02767","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:9b5dc1e874a1e5f1bf7ecab7fba34b277469e2b350fe123f4cd3666b4dddc973","observation_id":"5abd5bbe-1b5e-4136-ac03-f0cbe19911bf","resolution":{"observed_at":"2026-08-12T12:29:19.549093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09022","last_updated":"2021-06-16T20:43:56Z","snapshot_observed_at":"2026-08-16T18:16:34.560199Z","submitted_at":"2021-06-16T20:43:56Z","title":"A Simple Fix to Mahalanobis Distance for Improving Near-OOD Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09022","snapshot_observed_at":"2026-08-12T12:29:19.552396Z","title":"A simple fix to mahalanobis distance for improving near-ood detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.552396Z"},"links":{"cited_paper":"/paper/2106.09022","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:8e85d6ced82438c99fd88ae40b52ad8c5dbe9b42496561d256b23b702b691af3","observation_id":"f7d6be4a-f037-4017-8235-59137f33babe","resolution":{"observed_at":"2026-08-12T12:29:19.552396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.838732Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":"d11492de-29a1-4330-a0a2-f4e3010ef671","year":2015},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.555223Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:c2b35ada6c7b405b95af66f08b15354495ac8a7da8e57bbcedd8ecc5693084b3","observation_id":"aa44bce9-6c54-4c46-b112-92350b57d62b","resolution":{"observed_at":"2026-08-12T12:29:19.842923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.828997Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks, 2024","venue":null,"work_id":"401e572b-5793-4de6-b4ff-d0d4afc47ab1","year":2024},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.558406Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:5ae0a17051b479aef79b13da8e84dfd466c72880d1b6f9b62f5ee815849e175e","observation_id":"2a0cad95-fe93-4ed8-9465-4c1344df49c1","resolution":{"observed_at":"2026-08-12T12:29:19.832855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.820632Z","title":"Segmenter: Transformer for semantic segmentation","venue":null,"work_id":"7cfae7e2-5de5-44c5-b715-83625b488d40","year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.561383Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:68717c86dbb69a14716f1c24f68c066845006253a7facc0d965010a33673bcbd","observation_id":"77c24e2b-6bf8-493c-80ea-59a709fae0e8","resolution":{"observed_at":"2026-08-12T12:29:19.823881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.810829Z","title":"FCOS: fully convolutional one-stage object detection","venue":null,"work_id":"1975ecbe-c314-46fe-a59a-f0e2df681821","year":2019},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.564742Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:0055fce18df6b1110f8238708b7820e4fb61fb5c446fbda126e7930c4b7af83a","observation_id":"7ace44a4-e4c5-4997-afc7-ebaeb2a9393c","resolution":{"observed_at":"2026-08-12T12:29:19.814462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.802060Z","title":"Mlp-mixer: An all-mlp architecture for vision","venue":null,"work_id":"f5f41163-35c4-4a05-bdd9-33d235220172","year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.567727Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:38c1e5afd5857a4485aafebad32b8358432a42cf0c7575d27259e38753d9479c","observation_id":"4156a6cc-b729-4b0a-97b1-42f170b0f3a6","resolution":{"observed_at":"2026-08-12T12:29:19.805593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.793664Z","title":"Uncertainty estimation using a single deep de- terministic neural network","venue":null,"work_id":"a4295bdf-9d06-4d2b-98d6-a5585f07cd5a","year":2020},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.571324Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:8852de56ab6e0a0eb76e424540ed6f117c600bc03e22eef716701f8a4173fa5e","observation_id":"26c2a2fc-1f57-4ae5-bf6a-354d68f0520c","resolution":{"observed_at":"2026-08-12T12:29:19.796758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.785499Z","title":"Segment and Caption Anything","venue":null,"work_id":"7f15c62e-20a2-4afd-86a5-7e9b5c077cc2","year":2024},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.573983Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:5067dd74f312e894cbfcf8d273f9acbf4b8ff06683536472ce9a77ab27d61a32","observation_id":"38b93938-d8ea-49e2-9984-c74dd976da28","resolution":{"observed_at":"2026-08-12T12:29:19.788332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.776887Z","title":"Segformer: Simple and efficient design for semantic segmentation with transform- ers","venue":null,"work_id":"4c43db73-4e95-4b5c-b7ab-6473a4d0af6f","year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.577289Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:fd969b8260f50e6ad6eb0e26e68aefccc805532805ee765b89f86ab6b9c7edb9","observation_id":"d944d3cf-8d87-4d1a-a494-413cb6194d3e","resolution":{"observed_at":"2026-08-12T12:29:19.780182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.768338Z","title":"BDD100K: A diverse driving dataset for heterogeneous mul- titask learning","venue":null,"work_id":"7593dab6-fa92-4453-b4a8-9071e14b9856","year":2020},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.580430Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:681ec27044feb3f796ed0e9db674f7a0a4631e46599070168a8bd4074ba28c2f","observation_id":"3fa64e05-9132-494d-ba8d-46451166ae6c","resolution":{"observed_at":"2026-08-12T12:29:19.771694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.760068Z","title":"mixup: Beyond empirical risk minimization","venue":null,"work_id":"ae453c80-ae1b-4ea7-bcc0-bc111f5e0cd5","year":2018},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.583446Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:ca6602a18b80a167ad7187300f76b9e9f730de9059454ab561e9a8eb6e8fce86","observation_id":"faa4d9e0-2d0c-4ebf-96fe-dfc7b55f1fea","resolution":{"observed_at":"2026-08-12T12:29:19.763149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.750795Z","title":"Dino: Detr with 10 improved denoising anchor boxes for end-to-end object detec- tion","venue":null,"work_id":"62b90188-8c13-4c8e-9b43-3ef642f78af0","year":2022},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.586626Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:204380887922160509b7221434c7a3a5e66f31beca04c0fd7ae144e1b49dc952","observation_id":"384d1c59-a1a6-47fc-98f7-0047793a50dc","resolution":{"observed_at":"2026-08-12T12:29:19.754586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.740735Z","title":null,"venue":null,"work_id":"2cc54de4-f0d5-4bbb-9ac6-8e748aef7967","year":2024},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.589336Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:8ace390fd4b457f6615050daf909de331a6238c3e39e0bde9241e610694316bd","observation_id":"47dff8da-4215-4283-bee8-b05dfb7eb8f3","resolution":{"observed_at":"2026-08-12T12:29:19.744767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03514","last_updated":"2023-06-09T15:21:06Z","snapshot_observed_at":"2026-08-16T15:26:15.090405Z","submitted_at":"2023-06-06T09:00:10Z","title":"Recognize Anything: A Strong Image Tagging Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03514","snapshot_observed_at":"2026-08-12T12:29:19.592188Z","title":"Recognize anything: A strong image tagging model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.592188Z"},"links":{"cited_paper":"/paper/2306.03514","citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:5c524b0845adb325a256194e68cd1c8a867f0fd5f0b506ed75d4d8163119e509","observation_id":"8a8dd2be-8d2d-4c23-a879-2c776b88ecf0","resolution":{"observed_at":"2026-08-12T12:29:19.592188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.730939Z","title":"Segment any- thing model for medical image segmentation: Current ap- plications and future directions","venue":null,"work_id":"1eecbf4c-e3a9-4c05-b969-91e7e506a005","year":2024},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.595063Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:425d3e841ecefe82d52666569c54625325e6957868797924407579e5bd42fca3","observation_id":"43c76f38-bf62-46d2-8ea4-22fd8aded3c6","resolution":{"observed_at":"2026-08-12T12:29:19.734783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.722325Z","title":"Analyzing and mitigating object hallucination in large vision- language models","venue":null,"work_id":"476f83f9-0c67-4ff0-88c0-9da829f5d58a","year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.598797Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:20c8438b09d5a37d2357751351fb96cb511305ff7a3771f7ac85de53f428a340","observation_id":"78c0c8a3-c318-4216-9596-9a993497440b","resolution":{"observed_at":"2026-08-12T12:29:19.725473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.713293Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":"9923ef9e-f4fc-4d53-900b-74998b47cde7","year":2023},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.601412Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:ea99f915dc5028f02fe260588a09863737ccd2ddd698629e80b768f6163e3896","observation_id":"a7a19111-a069-4b6e-a240-9c33151333a9","resolution":{"observed_at":"2026-08-12T12:29:19.716744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.702830Z","title":"Deformable {detr}: Deformable transformers for end-to-end object detection","venue":null,"work_id":"f1c99086-97ca-425a-8f30-4108a78bc950","year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.604393Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:bfe1e4866c01574a4c4b7577c9e68b24bf6f174b38fc3a8b526a2df0c4b0585d","observation_id":"d33e20bd-6c8e-4c54-9c2b-b0e282f5667f","resolution":{"observed_at":"2026-08-12T12:29:19.706904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:29:19.692031Z","title":"dog” and “bird","venue":null,"work_id":"d436b5fd-1807-4c7c-b187-4ed42b8ec709","year":2021},"citing_paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T12:29:19.607156Z"},"links":{"citing_paper":"/paper/2411.17767"},"observation_digest":"sha256:623e31bbbb74c38e6d42612f88c73bff569931880fde38619f7597471e0ae032","observation_id":"3f17c30f-ce47-4a7a-b098-7b9875e5b295","resolution":{"observed_at":"2026-08-12T12:29:19.696189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17767","last_updated":"2024-11-26T07:14:30Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T12:54:03.808817Z","submitted_at":"2024-11-26T07:14:30Z","title":"Exploring Aleatoric Uncertainty in Object Detection via Vision Foundation Models"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 3 inbound Pith citation observations for arXiv:2411.17767."}