{"as_of":"2026-08-15T04:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98f918790af510fc8dd4c97f20d5ec9a1f8c212aeb492bd03da883b3df309977","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:48:02.948785Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15933/citation-record","integrity":"/paper/2411.15933/integrity","json":"/paper/2411.15933/citation-record.json","paper":"/paper/2411.15933"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2202.05930","last_updated":"2022-02-11T23:15:01Z","snapshot_observed_at":"2026-08-14T17:39:28.013143Z","submitted_at":"2022-02-11T23:15:01Z","title":"Detecting out-of-context objects using contextual cues","version":1},"cited_work":{"arxiv_id":"2202.05930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.05930","snapshot_observed_at":"2026-08-12T13:48:03.148677Z","title":"Detecting out-of-context objects using contextual cues","venue":"cs.CV","work_id":"cddc2546-7fd5-4ed9-9958-f6261041d765","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.682901Z"},"links":{"cited_paper":"/paper/2202.05930","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:386d8630f836dd811e1b3aed1606e90002e3050e385568396f15501bf921c142","observation_id":"331de153-78fa-4148-a497-469a9c5992b2","resolution":{"observed_at":"2026-08-12T13:48:03.152528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.799703Z","title":"Masking strategies for background bias removal in computer vision models","venue":null,"work_id":"ad291bf4-11e9-4bc2-bae1-f41fa8830196","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.687941Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:7119e325ae5e1dc70e68208cf3094d4c8bf72ac031807664a70c997e2c5c5ac6","observation_id":"4c66eb94-57ad-40a3-a009-829a9d5133e7","resolution":{"observed_at":"2026-08-12T13:48:03.803159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.789806Z","title":"Masktune: Mitigating spurious correlations by forcing to explore","venue":null,"work_id":"3df3f526-a74f-42d3-af98-a65174633357","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.692043Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:0ab1b8383cf67e11941b9215b7a4875c80bfe4c4ceca8c0b24df1c1b66238abb","observation_id":"457dc473-8042-430d-9890-c5ad937ea33d","resolution":{"observed_at":"2026-08-12T13:48:03.793061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.780388Z","title":"Objectnet: A large-scale bias-controlled dataset for pushing the limits of object recognition models","venue":null,"work_id":"897c81ec-d69c-4e2c-bdc7-a82848dae7ee","year":2019},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.695724Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:01bdea1f563bd1c343e6c18f2ea0e8f32e96101cb0a752cd98640855f7adb073","observation_id":"1e1f4271-db30-40a7-a6cf-f508341cd724","resolution":{"observed_at":"2026-08-12T13:48:03.783931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.771075Z","title":"Bird- snap: Large-scale fine-grained visual categorization of birds","venue":null,"work_id":"00660813-83d0-4097-bf9f-f81e13531bd4","year":2011},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.699567Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:4ca8797e2eedb5cec6d850dca17b9e73b40b0eca9f29413608d0a0324c8b0107","observation_id":"f7746e95-65b3-4227-b0bd-50c4c25f323c","resolution":{"observed_at":"2026-08-12T13:48:03.774553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.761410Z","title":"Are we done with ImageNet? 2020","venue":null,"work_id":"a6f3c9a9-d0f3-4f52-b807-c3195488fb70","year":2020},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.703002Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:bb801286dfbd3cb6bf604af1509d2cfba98348e92587cab3adef6273878555fb","observation_id":"0f13b7fa-774b-4110-811a-a3449598665e","resolution":{"observed_at":"2026-08-12T13:48:03.765003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.751726Z","title":"Mitigating the effect of incidental cor- relations on part-based learning","venue":null,"work_id":"f442c0a8-eef8-4d36-8115-dd8aca7a219c","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.706679Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:d5165e81cacb94cb2a5e062643520c5028d31517ee7d28621c3e1ae7741b8171","observation_id":"07d8afe5-7af0-4a86-adf8-5ed0d5aff1a0","resolution":{"observed_at":"2026-08-12T13:48:03.755241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.710040Z","title":"Masked-attention mask transformer for universal image segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.710040Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:a3dc3cbc8a29034e4c7bcef11fd2ce84a1026da3f79ac5c075f90ab446e73b3a","observation_id":"2fa2aa9e-4ead-4cc0-b867-35c2e4ab3c9f","resolution":{"observed_at":"2026-08-12T13:48:02.710040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.736321Z","title":"Putting the object back into video object segmentation","venue":null,"work_id":"cd76e30e-f82b-45c8-b80a-6ce767bac8dc","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.713197Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:afde049c566bbf5c131fd52cd4a6abf564365a43eb838685a781674904ca3386","observation_id":"8cda15c0-835a-4655-a1ed-23ca0e28a9b9","resolution":{"observed_at":"2026-08-12T13:48:03.739674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11646","last_updated":"2022-06-23T12:06:54Z","snapshot_observed_at":"2026-08-13T15:18:11.028797Z","submitted_at":"2022-06-23T12:06:54Z","title":"Invariant Causal Mechanisms through Distribution Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11646","snapshot_observed_at":"2026-08-12T13:48:02.716475Z","title":"Invariant causal mechanisms through distribu- tion matching","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.716475Z"},"links":{"cited_paper":"/paper/2206.11646","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e9f5161e90ac43e0cce163c8d4662cf3fc540facaa0aa3985bd97b5c720f586e","observation_id":"b36737d8-c8ca-46cb-9731-eded1020b854","resolution":{"observed_at":"2026-08-12T13:48:02.716475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06442","last_updated":"2023-04-25T00:51:55Z","snapshot_observed_at":"2026-08-13T12:27:08.916371Z","submitted_at":"2023-03-11T16:43:59Z","title":"Fine-grained Visual Classification with High-temperature Refinement and Background Suppression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06442","snapshot_observed_at":"2026-08-12T13:48:02.720072Z","title":"Fine-grained visual classification with high-temperature re- finement and background suppression","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.720072Z"},"links":{"cited_paper":"/paper/2303.06442","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:30b84284b616b38323461b1a010d7e93abce5a9f3b15000ac1faa7924a60a9b9","observation_id":"b8a6c2d3-6bcc-407b-a309-b5a237ee16ff","resolution":{"observed_at":"2026-08-12T13:48:02.720072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.726666Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"982a1abc-14c4-44b5-baf5-8a491069c44a","year":2009},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.723622Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2c241ec76b1992586740700e6867d09df3aa8352505e7626de1230035590b8da","observation_id":"4e248843-3078-40ad-b3bb-b80952598931","resolution":{"observed_at":"2026-08-12T13:48:03.730180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.716051Z","title":"An empirical study of context in object detection","venue":null,"work_id":"4ba3e03a-ed10-4e12-9b7d-2a14b1e6b5c0","year":2009},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.726989Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:22bdbe2d5c2cd991474ede805910f842ad5e77b7ca560627171d3f97febead7e","observation_id":"d293c5e4-64f2-4bfa-ac8e-1c8d3c2fda80","resolution":{"observed_at":"2026-08-12T13:48:03.719361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.706542Z","title":"Network calibration by class-based temperature scaling","venue":null,"work_id":"52d5520e-ad4a-45dd-8590-10830feac023","year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.730204Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:3b13d095e700cb99947a4ac7846137043797a68e8f36d601bc7f59fe08465c76","observation_id":"c26ed2b6-531b-48f3-8385-be0f3f82978b","resolution":{"observed_at":"2026-08-12T13:48:03.709986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.733297Z","title":"Shortcut learning in deep neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.733297Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:0005dd68fbef51a174f6addcb2bb1f6090171b76a39435b4aaaa7f8bc219e549","observation_id":"b1228ce9-5328-4323-bb9f-1f1cbabff51c","resolution":{"observed_at":"2026-08-12T13:48:02.733297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.691644Z","title":"Aspire: Language-guided data augmentation for improving robustness against spurious correlations","venue":null,"work_id":"6a0e6111-3342-4ba5-85cd-5af996d0dddf","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.736629Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:164677f2b068d10b9e016e8844e6d1e4d6bd300cce408d10770c9f34274ccbf5","observation_id":"e786b4a5-92d6-4d90-bcc5-c3137a7587e8","resolution":{"observed_at":"2026-08-12T13:48:03.695125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.740083Z","title":"On calibration of modern neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.740083Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:aa67a5de1805433ef195e6fbbd5622053615cd1f9e367d906750e02ad3fc71f8","observation_id":"5ecc3c61-8c84-4636-aed3-9e0d2215bd3c","resolution":{"observed_at":"2026-08-12T13:48:02.740083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.676332Z","title":"The two dimensions of worst-case training and their integrated effect for out-of-domain generalization","venue":null,"work_id":"7fca92cf-45e3-4fd0-8636-f296be55ec45","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.743590Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:380a7430749077e85552e9ec827f2890e1e2b26c29943b421047a904e1e0a44c","observation_id":"2f7aba02-0a67-4b04-80f2-9eb88cb2170d","resolution":{"observed_at":"2026-08-12T13:48:03.680063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.747033Z","title":"Segment anything in high qual- ity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.747033Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ed73fc6366e21987f46c3366e0430a6ff05d2f9fb85cbc6ae86fc89ccdbf4f88","observation_id":"9cc46470-ffc7-4fb0-9f67-c6adb9fa3d4c","resolution":{"observed_at":"2026-08-12T13:48:02.747033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.661573Z","title":"Novel dataset for fine-grained image categorization","venue":null,"work_id":"d0a75a3c-09cf-40d4-83aa-8213e983abb1","year":2011},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.750481Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e8c3944b59a3defb864cff042dbdc97b7362484aee6a1ab911abe96a4200d74c","observation_id":"95dde192-8578-421c-9936-6f35005e0f6f","resolution":{"observed_at":"2026-08-12T13:48:03.665131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.651856Z","title":"Segment any- thing","venue":null,"work_id":"0bde079e-ef26-4d2a-801d-a86032b86e4d","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.754105Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:02e42e8731ce917cbb0d0a0c8833c2b2f3391e364aba80ad6129b3b551a8ea20","observation_id":"10b8ceae-6597-49b0-9ea6-be05f10e9c69","resolution":{"observed_at":"2026-08-12T13:48:03.654968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00076","last_updated":"2024-11-26T16:47:59Z","snapshot_observed_at":"2026-08-12T11:55:22.118563Z","submitted_at":"2024-11-26T16:47:59Z","title":"Flaws of ImageNet, Computer Vision's Favourite Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00076","snapshot_observed_at":"2026-08-12T13:48:02.757441Z","title":"Flaws of imagenet, computer vision’s favourite dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.757441Z"},"links":{"cited_paper":"/paper/2412.00076","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:457199a916dc2b21862f91a9d8b707344246872b3030e056c36e11accc0fa70e","observation_id":"fd813e93-ef15-4dec-8e9d-127cf0c22f64","resolution":{"observed_at":"2026-08-12T13:48:02.757441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.642321Z","title":"Out-of-distribution general- ization via risk extrapolation (rex)","venue":null,"work_id":"e963c0aa-12f3-4bc3-a7a7-7ea68ea83ca2","year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.761303Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:49d71122b44e60a9c1db86f30358c77466a140375bac634cb702ee57d1d32c99","observation_id":"b0d5d177-5654-487a-8a98-cf64fa805ba5","resolution":{"observed_at":"2026-08-12T13:48:03.645635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.764531Z","title":"Domain generalization with adversarial feature learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.764531Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:96c1cb90ced591ee883a26c2adf12eb9d2eaaafdfc778e13d5ab396d37e83955","observation_id":"1ed2ce4a-4dc5-4fb7-ab81-a4d75135a959","resolution":{"observed_at":"2026-08-12T13:48:02.764531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.627329Z","title":"Just train twice: Improving group robustness without training group information","venue":null,"work_id":"ec85d7ac-b041-4fa0-883e-3d2f4b9ce9a4","year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.767768Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:88e28992bd697a1eb61d14faec35ef11fdc77276966640ab240f849d03202c08","observation_id":"a3c26aae-d4c8-4578-a27a-fa3a5a2fc33a","resolution":{"observed_at":"2026-08-12T13:48:03.630564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-12T13:48:02.771326Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.771326Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:5f4a02bc18d786bdea8baa4107beb2ac4bdaab4173d2d0f720af5ac87d6871d3","observation_id":"b4e3838d-e24c-411a-8870-726f77a70435","resolution":{"observed_at":"2026-08-12T13:48:02.771326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.618191Z","title":"A convnet for the 2020s","venue":null,"work_id":"85443e31-e500-4a66-98be-c0c7749ce6f6","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.775349Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:1faa2bf72d07e6ba7d0238e78b1b7c653e6f47200ae825b27ea897bd96b384b7","observation_id":"3525376d-448c-4fab-a464-5f2d671cf44d","resolution":{"observed_at":"2026-08-12T13:48:03.621372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.608511Z","title":"Camouflaged instance seg- mentation via explicit de-camouflaging","venue":null,"work_id":"bb3d32a4-fec1-49e5-aa9b-580436f3c4c4","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.778907Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:8d29bb9a07b7c0f4262ee05fa39351c0779991d6a600ee8324105f66813b8248","observation_id":"83e12622-da3b-4abf-9700-909612643334","resolution":{"observed_at":"2026-08-12T13:48:03.612056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.599095Z","title":"Spawrious: A benchmark for fine control of spurious correlation biases, 2023","venue":null,"work_id":"effefa01-75b9-4325-b331-0aa814d2dec7","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.782617Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:91bb8393c80789daa19b42f6eaf140f94b25285d77535fcff6502f4a2af30ade","observation_id":"62665785-c0ae-4439-9f4e-62ba239608f3","resolution":{"observed_at":"2026-08-12T13:48:03.602381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.590015Z","title":"Simple open-vocabulary object detection","venue":null,"work_id":"2d204e23-ab4e-4bd2-abb0-f87fc6d6e674","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.786006Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:775b59a507224fda40f3147e2d63106a236f9b76902baa506cb2a9ca47af60ee","observation_id":"09bfe1ab-9b95-429f-84e6-31f856104edd","resolution":{"observed_at":"2026-08-12T13:48:03.593207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.578893Z","title":"Scaling open-vocabulary object detection","venue":null,"work_id":"0273fbf6-2115-49fe-aa4a-299934224f6a","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.789303Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:6e24f9b36f24c3ab9a053f74dae5ff0a5fd0417f4a50f7ce52556b2af9371cdd","observation_id":"d6a3df7a-f7a5-40ac-b3fb-26f45112684d","resolution":{"observed_at":"2026-08-12T13:48:03.582437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.568837Z","title":"A comprehensive study of image classification model sensitivity to foregrounds, backgrounds, and visual attributes","venue":null,"work_id":"801f662e-a8ae-4195-a968-0f89438b7785","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.792820Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:836b063b235954e05a5d4507f5ebe40db70a2fecec86b30e85317dac22411e8d","observation_id":"ef3c50ba-5467-473c-a721-376ef695be5f","resolution":{"observed_at":"2026-08-12T13:48:03.572400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.559446Z","title":"Hard ima- genet: Segmentations for objects with strong spurious cues","venue":null,"work_id":"e84cf8e8-d789-4e33-b48b-db79670f948d","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.796368Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2d88ca080805d4bbeee2f1f6bbcf7676f41d688efaf05a0869a10c0e58ba5084","observation_id":"1a8bb286-dfb0-46f6-b57e-8754adcae17e","resolution":{"observed_at":"2026-08-12T13:48:03.562748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.549839Z","title":"Obtaining well calibrated probabilities using bayesian binning","venue":null,"work_id":"0668ae7f-2ed9-4214-a012-e10661571d92","year":2015},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.799729Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:05684f97c7a061f3eef1a04647719fb10e85ea17eeb79086e65af701d350ed06","observation_id":"b0a52eca-bf84-4c6f-a25d-6c2b0420bf94","resolution":{"observed_at":"2026-08-12T13:48:03.553252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.540204Z","title":"The role of context in object recognition","venue":null,"work_id":"edf977aa-19c7-405e-a189-4c3d6e7f836f","year":2007},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.803196Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:c53f0ac388cafdfd6c10afb6781e65be4f5b9d315606199fc1614dc3e10442ef","observation_id":"be4e5677-cb8d-412b-8d82-ed06505509d5","resolution":{"observed_at":"2026-08-12T13:48:03.543514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-12T13:48:02.806501Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.806501Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:797efcf3df5e07398d7477dfca9a2dcaa2871014c216d7426a4e02c7c249e851","observation_id":"9592cc9d-a722-4765-9a7d-72a7d6e45c56","resolution":{"observed_at":"2026-08-12T13:48:02.806501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.530971Z","title":"Jeppe- sen, Jacob Heilmann-Clausen, Thomas Læssøe, and Tobias Frøslev","venue":null,"work_id":"ac00f7ae-1cf4-441a-a8a9-ab260c7c10ee","year":2020},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.810326Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:28f81d9de2436d098d2f0d922dc76818a3f2b76892cc9ffe4513e0594dcbd308","observation_id":"5506d4cf-7f49-4518-a6f5-b483c51a9a38","resolution":{"observed_at":"2026-08-12T13:48:03.534548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13632","last_updated":"2025-04-25T07:11:09Z","snapshot_observed_at":"2026-08-12T22:58:06.064337Z","submitted_at":"2024-08-24T17:22:46Z","title":"FungiTastic: A multi-modal dataset and benchmark for image categorization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13632","snapshot_observed_at":"2026-08-12T13:48:02.813535Z","title":"Fungitastic: A multi-modal dataset and benchmark for image categorization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.813535Z"},"links":{"cited_paper":"/paper/2408.13632","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:88577bfedf829d2ef31b63ce9831b8f0ed4667850eb49c0857b0d3fe976d25f5","observation_id":"1c88b1b3-1e4d-4253-9336-a4fbd7e8b503","resolution":{"observed_at":"2026-08-12T13:48:02.813535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12930","last_updated":"2024-08-23T09:19:34Z","snapshot_observed_at":"2026-08-13T23:06:06.954863Z","submitted_at":"2024-08-23T09:19:34Z","title":"Animal Identification with Independent Foreground and Background Modeling","version":1},"cited_work":{"arxiv_id":"2408.12930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.12930","snapshot_observed_at":"2026-08-12T13:48:03.069371Z","title":"Animal Identification with Independent Foreground and Background Modeling","venue":"cs.CV","work_id":"30bfbcd6-6bf8-4b0e-a17f-839318ce0ab9","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.817054Z"},"links":{"cited_paper":"/paper/2408.12930","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:fd4afe405050ce3a9086b9d036a48a100fdc27d04416f6d2bfa7c5753b1b0547","observation_id":"0b47860e-526d-45e3-a085-6f2ede733d80","resolution":{"observed_at":"2026-08-12T13:48:03.075030Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.820538Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.820538Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:fc60e91d8a26151ff810ced8374c7a39cc8a4c49240cd035ed9d341074577c2d","observation_id":"05c4c926-4bab-47fc-bc04-9b95f2722165","resolution":{"observed_at":"2026-08-12T13:48:02.820538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-12T13:48:02.823678Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.823678Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:d8e3d0e163f39b09a5c6a9f4f5dd38188e745ac532a11574c164381e4bbfc153","observation_id":"d56b2503-2386-4572-9edb-ef39dcb964af","resolution":{"observed_at":"2026-08-12T13:48:02.823678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.516809Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"cfae6013-41db-4b6d-80f4-88da180ef57d","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.827207Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:559d522f4d9656456dbcc02d4551374ea15947c2d8c24ee2212398b0d0ea9b50","observation_id":"0dfa8ea0-3855-4a04-970b-f1cc957df6f4","resolution":{"observed_at":"2026-08-12T13:48:03.519756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.507787Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":"44a80764-7313-4532-9309-ee156e84d1fc","year":2015},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.830419Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:4214557edc48072d9625172afe6b6d32459898ca18e69433b0dc73c7bc024a25","observation_id":"8ea23f64-b02c-4ada-a150-3ee2ac881de9","resolution":{"observed_at":"2026-08-12T13:48:03.510906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08731","last_updated":"2020-04-02T05:40:29Z","snapshot_observed_at":"2026-08-14T08:06:00.989531Z","submitted_at":"2019-11-20T06:43:41Z","title":"Distributionally Robust Neural Networks for Group Shifts: On the Importance of Regularization for Worst-Case Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08731","snapshot_observed_at":"2026-08-12T13:48:02.833686Z","title":"Distributionally robust neural networks for group shifts: On the importance of regularization for worst- case generalization","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.833686Z"},"links":{"cited_paper":"/paper/1911.08731","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:6a7206578aa7664f94990a9a11478b0fe93edec0fe659db5f28af92987980bdf","observation_id":"70ec3682-04f2-473a-a588-458bd56b8ff5","resolution":{"observed_at":"2026-08-12T13:48:02.833686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.498627Z","title":"Not using the car to see the sidewalk–quantifying and controlling the effects of context in classification and segmentation","venue":null,"work_id":"bb962c62-49c8-49fb-9043-1434535b9caf","year":2019},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.837588Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:57dc719969f39c7c1c69d7c8dd2c8dccfc7bcb33cb05524a416047d352d2eebf","observation_id":"2c2c717c-400d-4a28-806d-e9ebd98d75f3","resolution":{"observed_at":"2026-08-12T13:48:03.501921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09937","last_updated":"2021-07-14T00:07:51Z","snapshot_observed_at":"2026-08-06T20:03:26.839485Z","submitted_at":"2021-04-20T12:55:37Z","title":"Gradient Matching for Domain Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09937","snapshot_observed_at":"2026-08-12T13:48:02.840950Z","title":"Gradi- ent matching for domain generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.840950Z"},"links":{"cited_paper":"/paper/2104.09937","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ba5f4c1abb43f651f7c01966a3796c5c202007dd7aeb337985c1fd4833f41c11","observation_id":"871465dc-9ae7-4099-9176-1db812638583","resolution":{"observed_at":"2026-08-12T13:48:02.840950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.489055Z","title":"Salient imagenet: How to discover spurious features in deep learning? In International Conference on Learning Representations, 2022","venue":null,"work_id":"19a51dff-4c47-4662-b590-f5e5dc2c5446","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.844668Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:bfa252d4495844d5df42c2c07f031bb7c8f273ba2f290cc7a33b341d86223faf","observation_id":"a233fca7-cc05-49ce-979d-ef475217de9f","resolution":{"observed_at":"2026-08-12T13:48:03.492535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.479564Z","title":"Bioclip: A vision foundation model for the tree of life","venue":null,"work_id":"aa780355-81c1-497b-a7ed-902baaaba8bc","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.847824Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:8d60dcf5bf687c5ccfcee9e7ee80dab2fb68a9f435201b605b5156e497c5ff0e","observation_id":"b62707f1-698d-44f7-9add-8a55a77e83ca","resolution":{"observed_at":"2026-08-12T13:48:03.482963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.469524Z","title":"Deep coral: Correlation alignment for deep domain adaptation","venue":null,"work_id":"f5e6d5d5-b8c6-441e-a298-3ef15d7bce7a","year":2016},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.851401Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e1be0bacf4c0fae61187bf6e55d6e56e6bd34102a85953a262dc2db46703bfd6","observation_id":"fe7fe90a-6c9c-4181-a1f6-40f60b408750","resolution":{"observed_at":"2026-08-12T13:48:03.473138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.458940Z","title":"Imagenet-hard: The hard- est images remaining from a study of the power of zoom and spatial biases in image classification","venue":null,"work_id":"01bfb2d6-ddb1-43d7-be0f-2696ea2fd626","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.854879Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:d2359dff3ebce249e29d7b6b76671bba91113cbe3ea725ee293d9a47ce8755cd","observation_id":"6861247d-7b60-45a2-a3a0-b11c49406da1","resolution":{"observed_at":"2026-08-12T13:48:03.463013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.448901Z","title":"Contextual priming for object detection","venue":null,"work_id":"609d7695-a972-4bc5-b062-831a4f84bb8c","year":2003},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.858078Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e2a7a790c06f9598243d7d6d9086527873701eee0c90e751f1df7eed45233eb4","observation_id":"ecb286ba-8366-47e1-b494-3ae0b7533bd0","resolution":{"observed_at":"2026-08-12T13:48:03.452466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-12T13:48:02.861359Z","title":"Siglip 2: Multilingual vision-language en- coders with improved semantic understanding, localization, and dense features","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.861359Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:cd02adc00b02578263d88215840ba6b1c595cfad821d25329677d471b6b29334","observation_id":"0e4552e8-2c22-44ca-ba45-224bf6e3718e","resolution":{"observed_at":"2026-08-12T13:48:02.861359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.439030Z","title":"Principles of risk minimization for learn- ing theory","venue":null,"work_id":"62b70e30-8687-4b42-aa4e-22cadaa32061","year":1991},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.865253Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:7c6daa7c1f8a5f26785bb1db73ebbf5eb9150708e61f621aeafd43854ca4e6b3","observation_id":"a621e092-8c3c-4444-8dc2-92bbb2052d9f","resolution":{"observed_at":"2026-08-12T13:48:03.442369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.429278Z","title":"When does dough become a bagel? Analyzing the remaining mistakes on ImageNet","venue":null,"work_id":"9588a8f2-0a46-4bc4-85af-3ad060bc4c6f","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.868663Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:687973e95ae1a148969071e218a420464ce6edebdf4f818946b058fc7c5129f6","observation_id":"db1f8213-2b74-44d8-86a5-eaedba5e5804","resolution":{"observed_at":"2026-08-12T13:48:03.432628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02748","last_updated":"2022-10-06T08:33:23Z","snapshot_observed_at":"2026-08-13T21:03:30.494857Z","submitted_at":"2022-10-06T08:33:23Z","title":"CLAD: A Contrastive Learning based Approach for Background Debiasing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02748","snapshot_observed_at":"2026-08-12T13:48:02.872256Z","title":"Clad: A contrastive learning based approach for background debiasing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.872256Z"},"links":{"cited_paper":"/paper/2210.02748","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:db3ab1c7b14eb641b132fb312145808aac599cc73ae628d74d6448e15ecbd730","observation_id":"91c4ee1c-9b6f-4dba-b35d-21c115132ab7","resolution":{"observed_at":"2026-08-12T13:48:02.872256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.419522Z","title":"A sober look at the robustness of clips to spurious features","venue":null,"work_id":"90eb8645-35b5-4423-8629-7da58a4016d0","year":2025},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.875839Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ef9da5fb442d25900f52265024c6a2369da2f24d684762462dfbacf9806aaffa","observation_id":"5c2586b2-0f56-4a93-a50a-4c348b9d00d8","resolution":{"observed_at":"2026-08-12T13:48:03.422857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.879044Z","title":"Pytorch image models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.879044Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:0d75c79f908c30b32efc1f8eb40166c52cac69dff2297e87b42f87a40ec66b3b","observation_id":"0e8cc2b9-770b-44da-96b8-5fe64faa054b","resolution":{"observed_at":"2026-08-12T13:48:02.879044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.405191Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"79d8474a-5285-43e9-b7d5-2c9ed0a9d662","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.882513Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:3c47025256520b8d6f116c1b51282e05f9e1f1a15a7a0d5152ae11d055654fe3","observation_id":"69d7bfc8-ad53-4992-ba29-f6fa4d35c02e","resolution":{"observed_at":"2026-08-12T13:48:03.408234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09994","last_updated":"2020-06-17T16:54:43Z","snapshot_observed_at":"2026-08-14T12:00:40.095980Z","submitted_at":"2020-06-17T16:54:43Z","title":"Noise or Signal: The Role of Image Backgrounds in Object Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09994","snapshot_observed_at":"2026-08-12T13:48:02.885740Z","title":"Noise or signal: The role of image backgrounds in object recognition","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.885740Z"},"links":{"cited_paper":"/paper/2006.09994","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:051fb649ab4d3d382f799d5abf8b544aee30d116d430a97015e90f20ce79369a","observation_id":"2b34f12e-213f-455a-8535-ca11b78112cc","resolution":{"observed_at":"2026-08-12T13:48:02.885740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.395905Z","title":"Adversarial domain adaptation with domain mixup","venue":null,"work_id":"cc18c05c-5754-4f75-adde-800290da1319","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.889360Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:d4919b8e8803f15e4ccd45deb5f52ed9e64de6252eec28fde4b3a174a64ac651","observation_id":"ff393fdf-e3d2-4ae0-a3b5-7857a46e45c9","resolution":{"observed_at":"2026-08-12T13:48:03.399447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.385934Z","title":"Significant feature suppression and cross-feature fu- sion networks for fine-grained visual classification.Scientific Reports, 14(1):24051, 2024","venue":null,"work_id":"5de10049-cd28-4786-8438-817b3766ee51","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.893258Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:a3829fb2fa01618ff795bf5431a6c4bebcf02ab37fce1423a88fb1fa190c7e21","observation_id":"6a13cff2-357d-4ecc-a655-b3d6eff51d7c","resolution":{"observed_at":"2026-08-12T13:48:03.389512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.896685Z","title":"Improving out-of-distribution robustness via selective augmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.896685Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:13809ebc00cd159111e76d3bde5ba8c80fd6f373529ce4e4322c8f5b5bc3d220","observation_id":"217849be-244f-4f29-b423-bc9bc0bbdea7","resolution":{"observed_at":"2026-08-12T13:48:02.896685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12156","last_updated":"2023-06-21T10:08:29Z","snapshot_observed_at":"2026-08-13T11:12:44.426861Z","submitted_at":"2023-06-21T10:08:29Z","title":"Fast Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12156","snapshot_observed_at":"2026-08-12T13:48:02.900021Z","title":"Fast segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.900021Z"},"links":{"cited_paper":"/paper/2306.12156","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:867d3a2c18f09564180c119a2a8269421612152f101cf0e5241fc5b33eb14898","observation_id":"86ebc9eb-c918-44bf-993f-1cc816f34e7a","resolution":{"observed_at":"2026-08-12T13:48:02.900021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.06596","last_updated":"2017-05-25T18:15:06Z","snapshot_observed_at":"2026-08-14T21:29:31.645319Z","submitted_at":"2016-11-20T21:20:32Z","title":"Object Recognition with and without Objects","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.06596","snapshot_observed_at":"2026-08-12T13:48:02.903556Z","title":"Ob- ject recognition with and without objects","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.903556Z"},"links":{"cited_paper":"/paper/1611.06596","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:95138db9028f0cf1e5cb6982e964a43a1ad314ee5bc177743eb08117ba6e4ae9","observation_id":"32e9caf6-c1d5-4b67-8246-d4072d9dadcf","resolution":{"observed_at":"2026-08-12T13:48:02.903556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.275045Z","title":"volleyball on snow","venue":null,"work_id":"36a7acc1-a227-46b2-8100-4daf29307436","year":2014},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.906942Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:591c2bde0406e925d74f1aa9d33bf7f21e6f760fd55ac820977fdae4f57fa4ab","observation_id":"b943c99e-3fa2-486b-80ac-f9cc535120c4","resolution":{"observed_at":"2026-08-12T13:48:03.373175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.266223Z","title":null,"venue":null,"work_id":"b2cc5b02-d77b-46ed-a1e0-5049af7a7574","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.910586Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:7154bc165b997be2709e001de8d4185c3cf9da72da5163014df17d01605ca3d7","observation_id":"f4f4d741-7ac8-4886-815a-775d4e82bc73","resolution":{"observed_at":"2026-08-12T13:48:03.269314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.257653Z","title":null,"venue":null,"work_id":"86e7b5bb-4430-46b4-80ad-a5b0b51c496c","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.913837Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:a355e5630b0cf784c532883a4fd12b43e7b9df5625f7599f989b7075f9118cf2","observation_id":"726872f2-eb8d-460e-b213-987fbe07cdae","resolution":{"observed_at":"2026-08-12T13:48:03.260735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.248050Z","title":null,"venue":null,"work_id":"36cbff60-f055-40b0-a82f-e5d4eebc2b34","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.917425Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:929f8d140e65587f337f370d5248f76911116e54f904f7ac9c738c0973dd1c16","observation_id":"182c8e4d-bc88-4c32-981e-b7217057b392","resolution":{"observed_at":"2026-08-12T13:48:03.251196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.239245Z","title":null,"venue":null,"work_id":"1d1e39da-4f3a-46b2-81d5-efac4d010d75","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.921142Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:d0ff332a443a3b8f8fc8fea1c454a7c6eebeff23e334c28570ca457cd26b00ae","observation_id":"38b078c5-fc63-48f2-99d6-b91244854cf7","resolution":{"observed_at":"2026-08-12T13:48:03.242295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.229909Z","title":null,"venue":null,"work_id":"0069d96c-fe74-4b4e-8de1-0417a10ebc96","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.924415Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:4fc70f46cf9a5e3870150a94dc5c18194f770078888383280b012dcb6c4434bf","observation_id":"7a796fcc-1e4f-414d-8f89-0ed1310f3f73","resolution":{"observed_at":"2026-08-12T13:48:03.233220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.220539Z","title":"the one with confidence ˆpi = max(ˆp1, ˆp2)","venue":null,"work_id":"75347fa8-40ba-454d-99fe-b2a4b6bba7b2","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.927966Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:b321c2f8d3d36fcbdde78506c4d5ecac7a270e09bc89f29b0058aafeeabd1a89","observation_id":"b64028f5-c775-4044-8858-a002b20cf0c7","resolution":{"observed_at":"2026-08-12T13:48:03.223750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.210164Z","title":"choose the one with ˜pi = max(˜p1, ˜p2)","venue":null,"work_id":"43258dc8-2a5d-4d0f-b4ae-32dc97ca71f2","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.931318Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2123a94b011a047b78441a2fb8de4a1747af5e41fae8161cfb763e1a83bdfc3c","observation_id":"ad016dad-88ff-42e6-b7f6-ec4125d0e3fa","resolution":{"observed_at":"2026-08-12T13:48:03.213904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.199075Z","title":"Here t >0 is a parameter maximizing the new prediction ac- curacy on the validation set","venue":null,"work_id":"4e47cdd9-0e21-4af4-8bb5-e967204de9a0","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.934580Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e0ea6be530a1e5e8c0c4359dcbc55a8d06dfb17ce2ac7043d1b12e7b46fdae01","observation_id":"3c5aa6f2-859a-419d-ac34-f371e8c416dc","resolution":{"observed_at":"2026-08-12T13:48:03.202763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.188406Z","title":"The prediction is given by argmax as usual","venue":null,"work_id":"c1fa2bb8-2468-41ae-9cad-bb3c930a2040","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.937907Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ce2a1a68e8de942028c94256a17115ca44b0ba5e87120af3f8e663eee150cca1","observation_id":"85bd9e91-ecc5-4551-a32a-aed2253ad25b","resolution":{"observed_at":"2026-08-12T13:48:03.192188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.177947Z","title":"The pose of flying birds is very different from those on the ground","venue":null,"work_id":"4b4fdd71-f6b4-48ae-b157-4889d0920f4e","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.941169Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:819a7bd23bd7f7240ada1ca112c0556cde6ef7f00e97f503c7d4404109e5de0d","observation_id":"4bb27e00-174c-4300-b4de-fd89aa6bba0a","resolution":{"observed_at":"2026-08-12T13:48:03.181476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.168182Z","title":", z(C) 1 , z(1) 2 ,","venue":null,"work_id":"f0a65fa9-358f-49ef-9f19-8f7b77fbb7fd","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.944619Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2773509d3261c937f1e1be6c73a3405bd2db9369cb31b01dd61539b71340bb98","observation_id":"473d8df3-dc4b-45ae-ac7b-23714be34137","resolution":{"observed_at":"2026-08-12T13:48:03.171538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.158958Z","title":"background","venue":null,"work_id":"4b079448-d33a-4377-b75d-7369a0256a26","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.948785Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:a9c234adfe929cf356feba72f43d65a989214165bed3534a32ded33787d42d08","observation_id":"7f681a5f-e023-4b4c-953b-ba4ee513726d","resolution":{"observed_at":"2026-08-12T13:48:03.162167Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T17:50:06.139583Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":47},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2411.15933."}