{"as_of":"2026-08-17T16:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b5c1c3057d9733c6eaa912f9bf3c96b0c9cf31aababc1f9c1319fbb45ec375f5","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:47:50.404759Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12724/citation-record","integrity":"/paper/2506.12724/integrity","json":"/paper/2506.12724/citation-record.json","paper":"/paper/2506.12724"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-07T00:47:50.338627Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models.arXiv preprint arXiv:2301.12597, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.338627Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:e92104a2f3445161193755627a5e00b44bfea6ee4d81fc25d109cf3e51aa1a98","observation_id":"b0963f86-4b0f-4522-ab6f-31c2a357a002","resolution":{"observed_at":"2026-08-07T00:47:50.338627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-08-17T03:00:38.806206Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-07T00:47:50.343150Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.343150Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:3b03034a7d9b932c7b99d784dad37afe071a18084118f42cebb4cc37233327ed","observation_id":"63157067-04a8-4578-be86-a399723a710e","resolution":{"observed_at":"2026-08-07T00:47:50.343150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12995","last_updated":"2023-04-25T17:05:38Z","snapshot_observed_at":"2026-08-16T15:37:47.663231Z","submitted_at":"2023-04-25T17:05:38Z","title":"AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12995","snapshot_observed_at":"2026-08-07T00:47:50.347136Z","title":"Pali: A jointly-scaled multilingual language-image model.arXiv preprint arXiv:2304.12995,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.347136Z"},"links":{"cited_paper":"/paper/2304.12995","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:5f1885e0fa1d001a96456e1498d7e02317233b1bf05a187a72a6ec7bc8b0295a","observation_id":"8df1b59a-afa1-4117-8617-be392739b705","resolution":{"observed_at":"2026-08-07T00:47:50.347136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T00:47:50.351305Z","title":"Visual instruction tuning.arXiv preprint arXiv:2304.08485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.351305Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:d8fa46b0651ea23e5046102f2088bd4901c953f992ff206264fda93084fcf4b1","observation_id":"8cf80597-a52a-49c0-92c0-165faf9c3c61","resolution":{"observed_at":"2026-08-07T00:47:50.351305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.630195Z","title":"Learning transferable visual models from natural language supervision.ICML,","venue":null,"work_id":"27a874a9-f41c-4c66-9aa7-3fe131703602","year":null},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.355500Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:d03511a4744ce97d686a13fdc84c8d9515a24267b0ccce33224654b59f21aff0","observation_id":"22a76260-dacd-4907-ab51-7bd2e730cf46","resolution":{"observed_at":"2026-08-07T00:47:50.634602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.08533","last_updated":"2022-06-13T14:16:14Z","snapshot_observed_at":"2026-08-16T18:50:57.685786Z","submitted_at":"2021-01-21T10:33:02Z","title":"Eliminate Deviation with Deviation for Data Augmentation and a General Multi-modal Data Learning Method","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.08533","snapshot_observed_at":"2026-08-07T00:47:50.362206Z","title":"Elimi- nate deviation with deviation for data augmentation and a general multi-modal data learning method.arXiv preprint arXiv:2101.08533, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.362206Z"},"links":{"cited_paper":"/paper/2101.08533","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:c108380c386df4ca9c172c614994759dbc18c7e4467486069b6feea7869a2da3","observation_id":"2a59e8b0-f24f-41d5-bd05-2840cc8bee1f","resolution":{"observed_at":"2026-08-07T00:47:50.362206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.618977Z","title":"Beyond dropout: Robust convolutional neural networks based on local feature masking","venue":null,"work_id":"6a079218-6b06-4908-93fb-b937c98c4641","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.366641Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:587be740df1b227d797080e71a7e988b480eb1932fd464d89536b3b195e85535","observation_id":"ed8536f1-1788-4ea7-ad09-fcb407202a97","resolution":{"observed_at":"2026-08-07T00:47:50.623042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02431","last_updated":"2024-09-04T04:18:25Z","snapshot_observed_at":"2026-08-16T13:21:32.789495Z","submitted_at":"2024-09-04T04:18:25Z","title":"Adversarial Learning for Neural PDE Solvers with Sparse Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02431","snapshot_observed_at":"2026-08-07T00:47:50.370161Z","title":"Adversarial learning for neural pde solvers with sparse data.arXiv preprint arXiv:2409.02431, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.370161Z"},"links":{"cited_paper":"/paper/2409.02431","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:ac5e96466e8ba8ed5b511e235a1b89e3cec33752c17e238f91ea6caf321f0a8b","observation_id":"6079d342-f93b-4f91-92a1-61c2daa5b5fd","resolution":{"observed_at":"2026-08-07T00:47:50.370161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.607702Z","title":"Cross-modality perturbation synergy attack for person re-identification","venue":null,"work_id":"b97b7f33-e90e-46ba-a69c-cd650b5fc871","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.374112Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:1f0671c54182c493c702c90cd2b8dd659297bd72536420e12878d9f2f9ea304b","observation_id":"63d7a74c-6298-4dd6-b5de-b9284b4c3f49","resolution":{"observed_at":"2026-08-07T00:47:50.611560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.594924Z","title":"Person re- identification method based on color attack and joint de- fence","venue":null,"work_id":"7ddaa4ca-7d3b-4b96-ae78-9db8a7821973","year":null},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.377269Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:916750ad9ea60702ebda1dacf703427dd5e6c11ec16506e599472e5618c0f960","observation_id":"a3b4d717-b914-4da7-ac5f-9c12c7eae8c6","resolution":{"observed_at":"2026-08-07T00:47:50.598727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10512","last_updated":"2024-01-19T06:04:48Z","snapshot_observed_at":"2026-08-16T14:26:15.296740Z","submitted_at":"2024-01-19T06:04:48Z","title":"Exploring Color Invariance through Image-Level Ensemble Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10512","snapshot_observed_at":"2026-08-07T00:47:50.380630Z","title":"Ex- ploring color invariance through image-level ensemble learn- ing.arXiv preprint arXiv:2401.10512, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.380630Z"},"links":{"cited_paper":"/paper/2401.10512","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:81cf1181e52094ee1565975b468e8f54e15912f2839e880d5adc71da1472bba6","observation_id":"2fcab2e8-ab84-403d-a4aa-6467d3bd12f1","resolution":{"observed_at":"2026-08-07T00:47:50.380630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T00:47:50.384237Z","title":"Gemini: A family of highly capable mul- timodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.384237Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:883dffc18616f52efec9fc91c4b7b3790f19fb8770588e0b8c8f948fdd67590a","observation_id":"d56c0bef-0640-4c1f-bead-306941044f4e","resolution":{"observed_at":"2026-08-07T00:47:50.384237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.582679Z","title":"Vilbert: Pretraining task-agnostic visiolinguistic representations for vision-and-language tasks","venue":null,"work_id":"8d67a164-69e0-49b3-8e96-5bf7eeeb5a8b","year":2019},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.388037Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:76e20f1151f23f96b945cac8bb2e705f0045ebb556126943c552aba20e2d75ca","observation_id":"a5ac239a-117d-4270-9e4d-9f27014e63a2","resolution":{"observed_at":"2026-08-07T00:47:50.587063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.571297Z","title":"Beyond augmentation: Empowering model robustness under extreme capture environments","venue":null,"work_id":"38bfda15-10e8-4929-abe3-e118f95fa8c0","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.391228Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:ff03d2286d9e614e205c464753c9e646809e4271a527ea688a091890994d4adf","observation_id":"7d61dd35-6492-489b-87f5-e39c460889b4","resolution":{"observed_at":"2026-08-07T00:47:50.575020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.561092Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning.ICML, 2016","venue":null,"work_id":"9fa9d428-4ea6-4579-bc55-9ac09aa287e8","year":2016},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.394484Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:3f195aa365c8e8010d42c021924266c95f70dd45efdd320dfebed215fbca3a7d","observation_id":"aeb203be-5b92-4b0d-adf6-6b8b06c9f952","resolution":{"observed_at":"2026-08-07T00:47:50.564612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17977","last_updated":"2024-09-26T15:52:34Z","snapshot_observed_at":"2026-08-16T13:15:04.437779Z","submitted_at":"2024-09-26T15:52:34Z","title":"Cross-Modality Attack Boosted by Gradient-Evolutionary Multiform Optimization","version":1},"cited_work":{"arxiv_id":"2409.17977","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.17977","snapshot_observed_at":"2026-08-07T00:47:50.448751Z","title":"Cross-Modality Attack Boosted by Gradient-Evolutionary Multiform Optimization","venue":"cs.CV","work_id":"8df5f66f-5df3-4a8e-a4fe-873bf9b254a8","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.397605Z"},"links":{"cited_paper":"/paper/2409.17977","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:3cdc34817f924aef5e78d77397b3922e02e0318f3c21ff047a29e616c74254b0","observation_id":"581db55a-9485-42fb-879b-bb5d41098147","resolution":{"observed_at":"2026-08-07T00:47:50.454735Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.551204Z","title":"Gshard: Scaling giant models with conditional computation and automatic shard- ing","venue":null,"work_id":"a32dc799-2182-4f7c-b3e9-8cd067e9556e","year":2020},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.401341Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:b587586e8b21c894a89539d535bf3a14dafa29108ca6c9543d29820244b4ab87","observation_id":"17e635bc-41fa-40bc-b221-7dd05fda1496","resolution":{"observed_at":"2026-08-07T00:47:50.554704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-08-17T06:55:10.468196Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-07T00:47:50.404759Z","title":"M3ae: Multi-modal model pre- training with masked autoencoders","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.404759Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:da1987c2802cac24abe46f9f4e9e1814054e46d6bfd64aa7d52e156ac2e9d4cc","observation_id":"8b568bdd-c956-4ff0-8550-f4dff723ec8e","resolution":{"observed_at":"2026-08-07T00:47:50.404759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T22:09:44.505320Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2506.12724."}