{"as_of":"2026-08-14T07:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f53721d43f80d4b53b85ead5dcac50067cc5c966c8b2165da85598fc14c170e6","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:57:50.043630Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05333/citation-record","integrity":"/paper/2509.05333/integrity","json":"/paper/2509.05333/citation-record.json","paper":"/paper/2509.05333"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.02524","last_updated":"2024-02-01T22:06:51Z","snapshot_observed_at":"2026-08-13T04:48:46.975482Z","submitted_at":"2024-01-04T20:23:51Z","title":"Comprehensive Exploration of Synthetic Data Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02524","snapshot_observed_at":"2026-08-05T12:57:49.932433Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.932433Z"},"links":{"cited_paper":"/paper/2401.02524","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:244de2ab047c9de447acab1147428741d6e8ffc10056b97f877f000dca2b7504","observation_id":"a9cb7832-0809-4b8f-a89b-47c88582f113","resolution":{"observed_at":"2026-08-05T12:57:49.932433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-08-14T01:48:52.921086Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-05T12:57:49.936216Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.936216Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:091cc33da30eea6432fa0d7097ede397edbf3132f7f0349a12619c09bcfa7b59","observation_id":"069d9977-c186-493b-86b3-33b791266ae6","resolution":{"observed_at":"2026-08-05T12:57:49.936216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.404208Z","title":null,"venue":null,"work_id":"85e25ff1-480a-4fab-b907-382314531efa","year":2020},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.939661Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:01af267cd50be234a7f104f78ec3cac8410f00d306dcfdc178b74f5e6ec1d47f","observation_id":"e0011386-8ae1-4aac-933b-4eca585abc40","resolution":{"observed_at":"2026-08-05T12:57:50.407109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-05T12:57:49.943388Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.943388Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:f10fb82ccca3e96283a6ff7435b2d0068ca9dd70d4558786f1719a8a79db6509","observation_id":"c62b17c4-81a9-43fd-884c-47acded4c33f","resolution":{"observed_at":"2026-08-05T12:57:49.943388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-08-12T12:44:22.350068Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-05T12:57:49.946863Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.946863Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:d2e79d24b00417507c81fd300ed1222a63e7fb20e22806a30be6c388a239b462","observation_id":"feb77488-855d-47d3-b5b5-32216d3995c5","resolution":{"observed_at":"2026-08-05T12:57:49.946863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-05T12:57:49.950164Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.950164Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:9d31779474a304395224c96abee1d466d550890d12b58ae6f2ed57b38e3d9bb0","observation_id":"fcf66b6d-d4eb-4f60-a4e3-2dc58c49a832","resolution":{"observed_at":"2026-08-05T12:57:49.950164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.396004Z","title":null,"venue":null,"work_id":"8f3ed02e-e24d-4cf5-aa38-4bdaf12dedbe","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.953434Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:348356f54c6514940e0c9410abdd7fb447693bb6502c9209660eed3bd63d24e1","observation_id":"00e74be6-12ec-43f5-a9c8-d9c1a1b407ec","resolution":{"observed_at":"2026-08-05T12:57:50.398791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.387263Z","title":"V.; Williams, C","venue":null,"work_id":"19b66e3d-7feb-4198-8c0d-fb694d157968","year":2010},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.956374Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:0727a8a777ba131c3441b54fbd8dc0079c72bba724660a6853ba24121cb48129","observation_id":"ba6a7179-9bec-46a2-89a2-4fbe1624debb","resolution":{"observed_at":"2026-08-05T12:57:50.390233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.378603Z","title":null,"venue":null,"work_id":"c6dfea9e-bf43-4728-a371-ee43547e9d8a","year":2016},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.959140Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:9551ac520261e45b4ddc16580e681a17ede07f330c268cfbb3864faea8f7e969","observation_id":"2e6e5224-cb7e-4522-a04c-465c38858d5f","resolution":{"observed_at":"2026-08-05T12:57:50.381644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12740","last_updated":"2022-05-25T12:46:21Z","snapshot_observed_at":"2026-08-13T15:37:19.071259Z","submitted_at":"2022-05-25T12:46:21Z","title":"SIoU Loss: More Powerful Learning for Bounding Box Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12740","snapshot_observed_at":"2026-08-05T12:57:49.961961Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.961961Z"},"links":{"cited_paper":"/paper/2205.12740","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:7ec105702a291494c149ab04bb569ca175c2b36c0fcf8b2f398684a2e1fd7c34","observation_id":"903e82d3-1963-411a-bdf9-0fd72d47f791","resolution":{"observed_at":"2026-08-05T12:57:49.961961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T12:57:49.965062Z","title":"H.; de Wit, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.965062Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:51c0f00df0b48ba923e388c93d47a2b6b07576c95b2ebb9112b94acb4da69fa9","observation_id":"7e648f74-b7d8-45a9-8dd8-9ec0b2cce9b0","resolution":{"observed_at":"2026-08-05T12:57:49.965062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.370485Z","title":null,"venue":null,"work_id":"eb2327d8-98b2-4fff-86e6-cf69f7c62811","year":2019},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.968714Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:4320a8fd5a2be0cdcbbc79c9f46c70caa46d20012973e711d4616be2ec63964f","observation_id":"974c6768-4e22-4c69-bbe5-e85489ab2292","resolution":{"observed_at":"2026-08-05T12:57:50.373182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.361476Z","title":null,"venue":null,"work_id":"a234892e-d1a9-4dc4-97b4-72109dbe178e","year":2021},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.971449Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:4469ab5a471095e6d18b19799b9895578bc0fe72cb5f48c6ac404a34b3be7b71","observation_id":"fd89def3-5cdd-4101-b04c-8723e734b8ed","resolution":{"observed_at":"2026-08-05T12:57:50.364556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.353011Z","title":"D.; Gesmundo, A.; Attariyan, M.; and Gelly, S","venue":null,"work_id":"958620cf-d19c-4f82-bb55-3d45d7bd7690","year":2019},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.974236Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:e806472e90b617d4cf3241432a0adf88bd9659da6efe5ae10ad2c04be0b51450","observation_id":"b5c885dc-ff38-47a2-9c7f-aca8799df3ef","resolution":{"observed_at":"2026-08-05T12:57:50.355842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.344325Z","title":null,"venue":null,"work_id":"9d853255-93c3-46a3-ae4d-69ae34a8e21a","year":2012},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.976986Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:1bba5572f6c55780daff2a9d8daeeceed29ee2932733b4ff50d80a36e4b77549","observation_id":"fc15d74a-015b-4e5e-ac10-4d73555f98b6","resolution":{"observed_at":"2026-08-05T12:57:50.347195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.335359Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":"3257b3e9-f41b-4f53-b14c-9550b8d23dac","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.979613Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:72abd134545680478bea6ed519c7bbd294073812a3f43d2e1a096d73388095bf","observation_id":"f3d31dc5-8998-47e6-aa88-4c6f6edd3ef3","resolution":{"observed_at":"2026-08-05T12:57:50.338460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.326765Z","title":"H.; Zhang, P.; Zhang, H.; Yang, J.; Li, C.; Zhong, Y.; Wang, L.; Yuan, L.; Zhang, L.; Hwang, J.-H.; and Gao, J","venue":null,"work_id":"78dcda57-eab4-4cdc-a334-ee0611816bf1","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.982278Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:fa96781697f62a74dec42c3214e25a39ead9175861154b569728fa83132529b2","observation_id":"bbbde29e-b1ff-4171-9594-26fbe585d450","resolution":{"observed_at":"2026-08-05T12:57:50.329692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.318473Z","title":null,"venue":null,"work_id":"4528769a-78d7-46ed-8fd1-6b1ac93691f3","year":2020},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.984977Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:3f37da8e54571389313aaac558e06a3836cc9f373dc79ee63bcbffe746a0b4d8","observation_id":"5b678613-6200-4975-9205-13080c3c1ed8","resolution":{"observed_at":"2026-08-05T12:57:50.321359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.310053Z","title":null,"venue":null,"work_id":"e8cb2cea-e2ad-4079-888c-e02f3bc62177","year":2017},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.987763Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:416fd3bbe9c2f6f8e0a493882e9737905c003155e51485a3349353cec5692b10","observation_id":"febfe0e4-208b-4c24-8ee5-f79714228d92","resolution":{"observed_at":"2026-08-05T12:57:50.312697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.301616Z","title":null,"venue":null,"work_id":"5c8730f6-5d9d-422a-97bf-c6ee6f08da22","year":2014},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.990909Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:ce6f018599e6caf294b56488a6804b27422811388bf0b7f39c733041d603bbd2","observation_id":"d33ac3c9-822f-47cd-b915-7e88e0fdedbe","resolution":{"observed_at":"2026-08-05T12:57:50.304358Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.292324Z","title":null,"venue":null,"work_id":"5511f85e-2b4d-4335-a67a-bc235ab0d5dd","year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.993538Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:54c5d64b7bdcb1b8c044fdec682e6bdb66240bb1a5bd3d68c1e44781772f916c","observation_id":"e0daeb7a-0fac-480a-8019-9551f71e8aec","resolution":{"observed_at":"2026-08-05T12:57:50.295450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-05T12:57:49.996179Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.996179Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:0ef3f0d4ddf21fb688f033926ac23acb58bd56e1485f882108434f06dcf2694c","observation_id":"3623ce49-775a-4d5e-a774-1a04e89016d1","resolution":{"observed_at":"2026-08-05T12:57:49.996179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.283398Z","title":"P.; Gupta, S.; Yazdanbakhsh, A.; and Clark, P","venue":null,"work_id":"fa4e2490-80a7-4c16-873a-38c785f45efd","year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.998889Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:7401ef746524fe98e6b21680262697b6700a057703acb63f3c0f48e2dba74520","observation_id":"fa91769f-ad0b-4ee4-b4d3-2f4d2c9f3747","resolution":{"observed_at":"2026-08-05T12:57:50.286762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.275013Z","title":null,"venue":null,"work_id":"a767e208-95c8-42d9-aeb3-25c4a451d567","year":2002},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.001658Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:69a2fee7e49a6d117a36edf7b77e44e6ef21c71a5014d3b38d131cbc995dcb87","observation_id":"0db3b4c5-137c-407f-98cb-fa592f189cae","resolution":{"observed_at":"2026-08-05T12:57:50.277912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.266544Z","title":"A.; Wang, L.; Cervantes, C","venue":null,"work_id":"fbe8c300-670c-4dd4-8181-a9d800a60453","year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.004503Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:dec0188fa1fd159ca3246d3c26d17870ab4d00c5382e795b649ee5c6dd588db3","observation_id":"f5608100-2cf7-402e-9dfb-40c81ab30eb7","resolution":{"observed_at":"2026-08-05T12:57:50.269345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.256555Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":"5aeb4348-325d-42a8-acb5-b562cd408e9a","year":2021},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.007374Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:569a51d97ba3d9f9721bb8deda4e0f91c79ec6eb64c9ae500906905843b1c241","observation_id":"c6067edf-571e-4a21-a93a-ff8f449932e9","resolution":{"observed_at":"2026-08-05T12:57:50.260662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.247657Z","title":null,"venue":null,"work_id":"988521fd-4eec-4b4f-948e-710eb9a4efcc","year":2016},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.010060Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:3e528d33f1f287230e96f475737a46f89cb976ddece8f6bcb06dc1ae97baf029","observation_id":"d8946a98-7f49-48ee-b1ac-3dd646110ac6","resolution":{"observed_at":"2026-08-05T12:57:50.250612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.238833Z","title":null,"venue":null,"work_id":"33960e71-cace-4c85-99b5-d152bd80dd2c","year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.012968Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:6198eafd31a0997c7ea15031972c43a5215c7133fa04ebfc377989a28aa410ca","observation_id":"4e74eaaf-38fa-413c-bec6-0f521b2b2dae","resolution":{"observed_at":"2026-08-05T12:57:50.241667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.230249Z","title":null,"venue":null,"work_id":"14f65362-1a3c-4186-a0c2-5bc35179dc46","year":2000},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.015601Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:7ebb21774fbd045da4b1873741818ac9cf64c7afe7daec0a55a79018b62599d3","observation_id":"0b1ec3a6-76e0-41da-826b-6ec0dae7de72","resolution":{"observed_at":"2026-08-05T12:57:50.233111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12524","last_updated":"2025-02-18T04:20:14Z","snapshot_observed_at":"2026-07-06T20:38:20.545914Z","submitted_at":"2025-02-18T04:20:14Z","title":"YOLOv12: Attention-Centric Real-Time Object Detectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12524","snapshot_observed_at":"2026-08-05T12:57:50.018357Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.018357Z"},"links":{"cited_paper":"/paper/2502.12524","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:ce66e2075724fe63da28d0c4f7c58ab428441539ca8afb95c7fbfc33837ad37e","observation_id":"f5723c00-55b2-472a-a5d5-b736346a5e27","resolution":{"observed_at":"2026-08-05T12:57:50.018357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.220750Z","title":null,"venue":null,"work_id":"2c1ff1af-e200-4c1a-be59-b396860511d1","year":1979},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.021455Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:551f2a58d91e5540dca81193e62e64edfce70d8963ec7bedc0dbbbbc1387a3ff","observation_id":"c02d1aeb-1f7a-4742-82bb-e9a20f45e119","resolution":{"observed_at":"2026-08-05T12:57:50.224074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.211186Z","title":"L.; and Parikh, D","venue":null,"work_id":"cd07ea3e-18d8-4160-9a60-283f0ab869d1","year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.024170Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:26018e606ec4c60d48f83515ef17711a3fc4e90fa59cc9c9212d9e3716696c8d","observation_id":"493e68d7-0132-4c6c-bb78-9870002fc4e9","resolution":{"observed_at":"2026-08-05T12:57:50.214251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.201616Z","title":null,"venue":null,"work_id":"15a269df-75d8-44dd-ba8b-2b17f74eb70e","year":2020},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.027049Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:884de2efdbdf893e020bef3a4da4dea4613b957d9e4f16dc4306860b6d70b946","observation_id":"b16a4f94-cb9d-4a24-9235-83d5c27cdc6f","resolution":{"observed_at":"2026-08-05T12:57:50.204763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06024","last_updated":"2024-09-14T21:47:21Z","snapshot_observed_at":"2026-08-13T11:45:18.065283Z","submitted_at":"2023-05-10T10:19:31Z","title":"A Survey on the Robustness of Computer Vision Models against Common Corruptions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06024","snapshot_observed_at":"2026-08-05T12:57:50.029553Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.029553Z"},"links":{"cited_paper":"/paper/2305.06024","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:e02c00bfacc451f9bba55c5b11cecd8f173abe14b48b809c6ec36eff2ec65ee8","observation_id":"8839ae85-9f93-4934-a8f1-0e3938841847","resolution":{"observed_at":"2026-08-05T12:57:50.029553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.191723Z","title":null,"venue":null,"work_id":"28d1c6b9-d74a-4005-b1f9-dce4297387ec","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.032638Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:2805183afb9eb596452c2ae4107d958a5241f90a257b9ac436b4114e4ed62cf6","observation_id":"777d05b0-e4d6-4c86-91c4-afc9085c1317","resolution":{"observed_at":"2026-08-05T12:57:50.194746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.182674Z","title":"B.; Su, H.; Mottaghi, R.; Guibas, L.; and Savarese, S","venue":null,"work_id":"a40a614e-3bbc-48ae-b174-824d3c8b8772","year":2016},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.035476Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:552de3e108890f7a8e6b0a08e32351249b3263786e6b8d8145b0355a422b687f","observation_id":"8fde0c18-c56b-4565-b7c1-42da6660c414","resolution":{"observed_at":"2026-08-05T12:57:50.185557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.172031Z","title":null,"venue":null,"work_id":"8275b29f-74b2-45c9-9439-e812246aff97","year":2014},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.038184Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:2e92a6ff617e31c3607b4b3ea24bcd4f156073245cdc3fbd781bbb291939af8a","observation_id":"62f35f80-48be-40fe-a891-3f8212fd7e74","resolution":{"observed_at":"2026-08-05T12:57:50.176176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.040779Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.040779Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:4002d30ccb478b7dbdc7e8a368b098470796c37fa6a675855fd9cc841328ef96","observation_id":"cd2b7515-09d4-40bc-a0d1-0ea44af0365c","resolution":{"observed_at":"2026-08-05T12:57:50.040779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.043630Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.043630Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:cc6bf7dd1855d885010df38d795e6466752fa1c0cd80157538c4414b12ac7a71","observation_id":"6ee52ded-9dfc-411f-b851-06bbab47848a","resolution":{"observed_at":"2026-08-05T12:57:50.043630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T09:09:13.532307Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2509.05333."}