{"as_of":"2026-08-09T19:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a73e1fce10a9fc50f3df60f1cbbab641f3dce5e579010b75a50b7fb927386ce4","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:14:36.026805Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T10:36:52.193683Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:50:10.036846Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2605.09253","last_updated":"2026-07-01T02:40:56Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-10T01:41:43Z","title":"Cornerstones or Stumbling Blocks? Deciphering the Rock Tokens in On-Policy Distillation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T22:52:01.824412Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2605.09253"},"observation_digest":"sha256:b9cfc69dfad6fca12d627e562955d2decb6416cd26af5c188d5fb38e65c2a122","observation_id":"195abef5-7693-4b98-8da7-f30a5c996ef6","resolution":{"observed_at":"2026-07-01T13:45:45.629052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2605.09253","last_updated":"2026-07-01T02:40:56Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-10T01:41:43Z","title":"Cornerstones or Stumbling Blocks? Deciphering the Rock Tokens in On-Policy Distillation","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-02T23:34:26.508233Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2605.09253"},"observation_digest":"sha256:c3ce3a5efd373c5ceffd4ff527c86f168e04e3f7a5821737f3ba8aa607db300b","observation_id":"06c0836b-7068-442d-8b02-09566db78c77","resolution":{"observed_at":"2026-07-02T23:37:27.066738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.00305","last_updated":"2026-06-29T12:51:52Z","snapshot_observed_at":"2026-08-02T00:46:58.308965Z","submitted_at":"2026-05-29T19:32:07Z","title":"Bridging Reasoning Trajectories in On-Policy Distillation via Near-Future Guidance","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-28T22:10:00.382359Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.00305"},"observation_digest":"sha256:e41dd965bb955c54c903f3e9ef15113d607de17218de7bc793de383d8f076383","observation_id":"90a88419-c005-40f0-98e2-5d2c4efc94a9","resolution":{"observed_at":"2026-07-01T19:46:10.101695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.00305","last_updated":"2026-06-29T12:51:52Z","snapshot_observed_at":"2026-08-02T00:46:58.308965Z","submitted_at":"2026-05-29T19:32:07Z","title":"Bridging Reasoning Trajectories in On-Policy Distillation via Near-Future Guidance","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-30T10:34:52.474916Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.00305"},"observation_digest":"sha256:3459432f1130ba61613b5b3c6b2589a3ab26125b4749756aac03f3099e0ca965","observation_id":"72536cac-3d96-4550-95ed-6567b7a8dbe3","resolution":{"observed_at":"2026-06-30T10:44:37.263247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.22394","last_updated":"2026-07-18T17:41:38Z","snapshot_observed_at":"2026-08-02T10:36:49.390429Z","submitted_at":"2026-06-21T08:49:50Z","title":"Curvature-Adaptive Consistency Flow Matching: Autonomous Trajectory Optimization via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T10:40:22.767129Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.22394"},"observation_digest":"sha256:5fdef754ad878650877daf5c719798d2b17515e90f4f31916bd0cff74666e392","observation_id":"f36e184e-edcf-4f53-9a64-b464abcc604a","resolution":{"observed_at":"2026-07-04T08:59:42.974911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-08-02T10:36:52.193683Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22394","last_updated":"2026-07-18T17:41:38Z","snapshot_observed_at":"2026-08-02T10:36:49.390429Z","submitted_at":"2026-06-21T08:49:50Z","title":"Curvature-Adaptive Consistency Flow Matching: Autonomous Trajectory Optimization via Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T10:36:52.193683Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.22394"},"observation_digest":"sha256:3ccfaf9ac20584c1edfe41ca9b0a6b3734e53297bcd2d9090f96f6e1c29cad9f","observation_id":"5ad42cec-a607-43d7-8467-5c082b4afc11","resolution":{"observed_at":"2026-08-02T10:36:52.193683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.25758","last_updated":"2026-06-24T12:32:01Z","snapshot_observed_at":"2026-07-07T00:00:12.737052Z","submitted_at":"2026-06-24T12:32:01Z","title":"Dual Distribution Estimation for Zero-shot Noisy Test-Time Adaptation with VLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-25T21:03:20.583079Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.25758"},"observation_digest":"sha256:8c996ef9bbf4ad807409cc16ab37b8b582179e21f6156df1197a24a7616e1ec1","observation_id":"b1731367-5e7e-4ea4-8b1f-be5e59290dad","resolution":{"observed_at":"2026-07-04T19:50:10.038480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.00039/citation-record","integrity":"/paper/2509.00039/integrity","json":"/paper/2509.00039/citation-record.json","paper":"/paper/2509.00039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:32.476553Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.476553Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:edf6e8e5f8f30ec612f549454fba0435d621fec983e4ef374d89efeeabe87403","observation_id":"ecf4d217-4123-456d-8dd0-9f6633beee66","resolution":{"observed_at":"2026-08-05T17:14:32.476553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:32.563542Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.563542Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:cc568b803b006fccd7fe2ba4bb3518d428970e038c4502fa20182df1c80daf68","observation_id":"1beb9875-5867-4b8b-9501-7c76760187d2","resolution":{"observed_at":"2026-08-05T17:14:32.563542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.968484Z","title":null,"venue":null,"work_id":"48e9c050-dd0c-4f78-b328-e747ee022e69","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.611027Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:16ca2ab402717ca93af50a9b9f684d964c69880cda70119d852cf041c5db7570","observation_id":"2d77f35d-3c7c-452c-af28-83ddfaa45e20","resolution":{"observed_at":"2026-08-05T17:14:43.041382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.757505Z","title":null,"venue":null,"work_id":"d962903f-e66b-46ee-8aef-1f684d42cb81","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.697925Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:083aaba676c12a495fc39d774a17004da787b5dd2b39be83fc4d6e723b068685","observation_id":"b5f735b7-a8b1-4cac-a53d-c168a9c92ab9","resolution":{"observed_at":"2026-08-05T17:14:42.870520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.513347Z","title":null,"venue":null,"work_id":"e281f69b-c680-49f9-a28e-739b5e283b5a","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.773280Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:3c1be5bfd68250749341352f979f2b06d67de51b180c46cff2acc68193d47cf9","observation_id":"727221aa-47f7-44c1-a9b9-3a6215368d14","resolution":{"observed_at":"2026-08-05T17:14:42.634258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.290565Z","title":null,"venue":null,"work_id":"8ec4a71c-b045-46c0-a828-0dddb0d22687","year":2014},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.842987Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:e4b9bd41f18a0e1c7ff58109ad6153adf01327a612ca430f2c6f282316a11394","observation_id":"447df630-0d42-453c-9a3e-7f97557443ff","resolution":{"observed_at":"2026-08-05T17:14:42.391801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:32.891146Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.891146Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:21e904a160e2c9c9e717591a2b3e3a1517fc7c6aaf1f90e9316192b52c72da8b","observation_id":"1184ec61-3fa3-48b6-b2d1-1e5098b55208","resolution":{"observed_at":"2026-08-05T17:14:32.891146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-07-06T05:55:22.966528Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-05T17:14:32.949592Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.949592Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:37e0729bb53b1dea2c99827f97a69c125dac3725e3f9bd984d867fe7b90ffd57","observation_id":"13a59f2c-3638-42d0-99eb-9889165e6d54","resolution":{"observed_at":"2026-08-05T17:14:32.949592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T17:14:33.010661Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.010661Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:00e212803dbaeb3941ec49d9140718cf2348b9790a9bbc949de4eb59120b42fb","observation_id":"da79cb77-60b3-4d27-97d1-564d3329dafc","resolution":{"observed_at":"2026-08-05T17:14:33.010661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.104546Z","title":null,"venue":null,"work_id":"e662c396-cea2-4e3f-8ea6-68ad73327d89","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.061979Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:107ffcfc5bf921d5d23568996b5398d435a34028d7e3d54602017f33ebd74347","observation_id":"809e4ca8-0a4d-40b8-bfbb-6803111dc5be","resolution":{"observed_at":"2026-08-05T17:14:42.168345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.942262Z","title":null,"venue":null,"work_id":"84f291ec-3223-487f-88ec-5576a6516129","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.128342Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:09c4fee64957e3979683db776527356d4c32e5eefd4fe5d20f93f92aa0cfc51b","observation_id":"347660c3-0a6c-4ab5-82bd-fb0301bdd214","resolution":{"observed_at":"2026-08-05T17:14:42.016504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17425","last_updated":"2023-11-06T02:47:51Z","snapshot_observed_at":"2026-07-06T16:25:38.571377Z","submitted_at":"2023-09-29T17:37:29Z","title":"Data Filtering Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17425","snapshot_observed_at":"2026-08-05T17:14:33.216333Z","title":"M.; Jain, A.; Schmidt, L.; Toshev, A.; and Shankar, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.216333Z"},"links":{"cited_paper":"/paper/2309.17425","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:a49d20317862c5792a772181166a9c76b20bc84fe8267576297710cd68ddf1ed","observation_id":"37497b73-f9e9-4edf-bcb0-c57cd4397010","resolution":{"observed_at":"2026-08-05T17:14:33.216333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.711677Z","title":null,"venue":null,"work_id":"84a153b5-8a32-46a8-b6bc-272117538929","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.268768Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:ee1fc59be96456ec9ed2870409924846d56ad52355ccaff5cdb6ec355c6e664c","observation_id":"585d3206-6b5e-4c04-a418-6a8da617e720","resolution":{"observed_at":"2026-08-05T17:14:41.813180Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.263471Z","title":null,"venue":null,"work_id":"55022d65-1663-4e0c-bb2e-ed66a16c7f1c","year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.322562Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:61def602c1a1f3145124612fcb414830d72aa8b437b4240f50adc25716af5814","observation_id":"7ac3277f-0a4b-4039-9f65-b7e161b08fc7","resolution":{"observed_at":"2026-08-05T17:14:41.429706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:33.422536Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.422536Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f3ce59238aa3f77afc9fda8f26a6212fda467902ce841de8fa5b6b4d7507a821","observation_id":"1516d860-12c8-46b1-bffd-12ecd9e6c566","resolution":{"observed_at":"2026-08-05T17:14:33.422536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.037533Z","title":null,"venue":null,"work_id":"9022a7a9-f3ba-452a-9f25-7dda39d92012","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.492049Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:4ec387dfc12e43b751c2ba038363915d4b7673f6e15992f0dc774a42e2d62d8f","observation_id":"33b650c4-9296-469c-90c6-a7c98dd0381a","resolution":{"observed_at":"2026-08-05T17:14:41.122913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T17:14:33.534475Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.534475Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b33bc05d2f4c2caf9e86a0be614a4451f63b0cddd3c03807132c5df12efada2c","observation_id":"be421b27-8478-4f83-aec1-15678ef3b5a9","resolution":{"observed_at":"2026-08-05T17:14:33.534475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:40.755662Z","title":null,"venue":null,"work_id":"fbdc95ac-1c0e-4222-a48c-a937d1286fbe","year":2025},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.647691Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:2ae2ea1472ebd4d4027aeda9a9155362cb1580ee74b75a2539f80df93c0ada36","observation_id":"2cb62e3c-e0b8-4d24-af2b-6e3933d82704","resolution":{"observed_at":"2026-08-05T17:14:40.883523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T17:14:33.745393Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.745393Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f963a7c595511f45875d014a7ddfd5da256b2ca29369c172724c88573bf22f34","observation_id":"d237722c-20c3-403a-ac7a-1da6da367d4c","resolution":{"observed_at":"2026-08-05T17:14:33.745393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.07675","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.294110Z","title":"B.; Jang, H.; and Hwang, S","venue":null,"work_id":"ac8648ad-be3b-4166-88fb-47efc63264e7","year":2025},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.853514Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:235289629cbd041b005ef255c6c2269c488041ab75a615562bc715d9cbcde5d5","observation_id":"97850cff-b376-4e85-af93-66604ad7ba62","resolution":{"observed_at":"2026-08-05T17:14:36.408324Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:40.468526Z","title":null,"venue":null,"work_id":"7a10f5c0-4fa1-489d-819f-47f815df8009","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.950338Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:9e470558f9a199db956fa1abaaf62df513995ff89c07853e448f5061d24f1cf1","observation_id":"602c16cb-fc30-458b-b909-0f7509607b18","resolution":{"observed_at":"2026-08-05T17:14:40.554043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:40.212891Z","title":null,"venue":null,"work_id":"76104045-0303-4a7e-b63e-9942e0fe2638","year":2025},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.044469Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f907c72b731f4946a338d063e90b8d2f454b7189db2d35ce67d717dd7119ceb0","observation_id":"39e2ab10-2edb-4c21-ab59-3be286c850af","resolution":{"observed_at":"2026-08-05T17:14:40.354013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.957471Z","title":null,"venue":null,"work_id":"1456d5b9-a608-434f-99e6-58fb2c4f8955","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.139320Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:2ae3494d320265e84cee6cddbaa9c206676bbca21c7979cc0f6b4a60dbb0ab8e","observation_id":"49229b96-2508-4fe3-a322-cb893978c0d4","resolution":{"observed_at":"2026-08-05T17:14:40.118387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.804846Z","title":null,"venue":null,"work_id":"1d68efb0-a34a-49ff-9e19-2b01ee50e1c5","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.240302Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:8031d68f593bee7169a6ce50c2ef244dda0eefda37642418229c51edf877cde6","observation_id":"507df20b-4ac1-4265-9be3-e279ee7f251a","resolution":{"observed_at":"2026-08-05T17:14:39.861888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.616870Z","title":null,"venue":null,"work_id":"9581b5a2-7d68-402a-92cc-60ac5ad7fafb","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.328696Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:8367ec7eb6c26c844550db980fe99c132708334665b3ea9dc3309f8c7292d947","observation_id":"cc944aef-79f3-4532-b6a5-b4ea7249696d","resolution":{"observed_at":"2026-08-05T17:14:39.701346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.345968Z","title":null,"venue":null,"work_id":"703176ef-fd92-4522-96eb-52c9703b0c78","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.407987Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:ab55f1a8d33a54eeeb2b512e987f65613013c05328cb5368b6e0770d4063b4a9","observation_id":"a051ce1b-6b00-4a55-b2b1-60d1a37087b9","resolution":{"observed_at":"2026-08-05T17:14:39.514023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.114539Z","title":null,"venue":null,"work_id":"b33151fa-0624-449f-a075-fc1280c270ad","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.505874Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f81731a2ec8981ed205c8048bd142201725b8eb18908913f7ac9e073f78661c9","observation_id":"546f1203-5019-4a7c-81a3-0e336e716a05","resolution":{"observed_at":"2026-08-05T17:14:39.193555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.006973Z","title":"M.; Vedaldi, A.; Zisserman, A.; and Jawahar, C","venue":null,"work_id":"b343b4cb-2205-4960-a04c-3a73c3eb059d","year":2012},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.554033Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:fcb2e04136c924239caf358fed9ecb4833407f4ab4a6e20e9f401cbdfb7edc62","observation_id":"b9071d40-059f-44be-81c3-e5754617c9a6","resolution":{"observed_at":"2026-08-05T17:14:39.078737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.911784Z","title":null,"venue":null,"work_id":"51e8a296-55f0-40f1-a905-248ced41caaf","year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.614373Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:e61b85357c8756cec7422177a0d32ae152c7251c63662f9eb02ed0c31b51cfad","observation_id":"29e9dc4b-bf00-4b6a-868c-56a5d58dd713","resolution":{"observed_at":"2026-08-05T17:14:38.963470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:34.683157Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.683157Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:0e7b99898896a4c193e628a6125765e079266570a4e954932cef424476c20e03","observation_id":"68c569a1-4b58-4cf5-8be4-14d1ae1dc789","resolution":{"observed_at":"2026-08-05T17:14:34.683157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-08-05T17:14:34.760216Z","title":"E.; Chassang, A.; Gatta, C.; and Bengio, Y","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.760216Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:7eca2583f892837b5e1088f197c4e723d1d81467ad9a0b8228cd99bb99cea2e3","observation_id":"71c2cf7b-7168-43ea-b6f0-4419c6dc8591","resolution":{"observed_at":"2026-08-05T17:14:34.760216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.739770Z","title":null,"venue":null,"work_id":"84c22f5e-3cf3-4e46-a462-e23a70af992b","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.795680Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:e985f0e6ca259b9e119cf6608a781877b5333002907ff57fd1ef9985773876e4","observation_id":"a6d5067c-ec1f-4170-86cd-84f3191d8f8c","resolution":{"observed_at":"2026-08-05T17:14:38.818815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T17:14:34.867560Z","title":"R.; and Shah, M","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.867560Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:93ac1af6d9e3e15f477cce7c273629dc0e5eb974482b08f98c2de5af6f7ec2a4","observation_id":"561e87ec-5ba1-4bdb-ae7e-9cdc8972db5d","resolution":{"observed_at":"2026-08-05T17:14:34.867560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.609775Z","title":null,"venue":null,"work_id":"407484c2-859b-4e83-97ab-a94111177601","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.931509Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:d2471895bf1b91b8b5c068a80bedf7f87ce1f6367d1cb3041d22bc15357d2aab","observation_id":"3054dde8-f780-4431-99f2-a267ad116c07","resolution":{"observed_at":"2026-08-05T17:14:38.672171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.522311Z","title":null,"venue":null,"work_id":"b3f04d78-ed72-4c9a-b649-ccc71fc121ef","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.018122Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:7d2f7f823b37cea50b5d63a9dedcaa2c5ccd5888a3af62827375cc59ad74b105","observation_id":"c933c95b-bf7d-4833-b897-ec47882b32c1","resolution":{"observed_at":"2026-08-05T17:14:38.557094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.416674Z","title":null,"venue":null,"work_id":"4fc4fd29-453f-44c5-99e7-3a46c95035ba","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.080441Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:2dfbcbcbd3d00b200c41cc2097760d3a91bd5bfc5a5afc2fcca9ac74c635e097","observation_id":"cfb82c9f-831e-4470-84f3-9f440a26e1a4","resolution":{"observed_at":"2026-08-05T17:14:38.470895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.313481Z","title":null,"venue":null,"work_id":"459da1df-234d-4729-b6db-13b38d5eff07","year":2018},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.109323Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:5a8ecc1c72c67e1f9fe63390357cc6444b42d2700b5f922320a98600af36a781","observation_id":"d02780b6-d9c8-4d7f-b63a-0f13d9ec64fd","resolution":{"observed_at":"2026-08-05T17:14:38.364951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.10496","last_updated":"2022-04-28T17:43:36Z","snapshot_observed_at":"2026-07-06T13:02:42.093125Z","submitted_at":"2022-04-22T04:41:04Z","title":"Multimodal Adaptive Distillation for Leveraging Unimodal Encoders for Vision-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.10496","snapshot_observed_at":"2026-08-05T17:14:35.170744Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.170744Z"},"links":{"cited_paper":"/paper/2204.10496","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:ee322b584bf55a999d194a1ebf201caea8a6feaa93f4ce77d50f168a47091f51","observation_id":"2c72dd15-3912-4388-ab23-7e1f15ffb57a","resolution":{"observed_at":"2026-08-05T17:14:35.170744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.190404Z","title":"S.; Wang, X.; et al","venue":null,"work_id":"6df946b8-5e8a-414f-b6f5-80602dbb3b73","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.251931Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:61851b2800358160acdbd45bc8caec9fd7468e7d6d9f710bc38133e4d0abaf6b","observation_id":"458552f1-7d10-4339-835a-8327ccd2204d","resolution":{"observed_at":"2026-08-05T17:14:38.232574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.060737Z","title":null,"venue":null,"work_id":"49c87ef5-e42d-4a38-9f86-6650f8f8be05","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.326509Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:3d1ba65599b5ee5905fe6955af58cc3c62aefdd1e7898055d9c24eef45904181","observation_id":"a9b742ea-b15d-4bc9-b577-b354ea71b5b6","resolution":{"observed_at":"2026-08-05T17:14:38.120462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.948694Z","title":null,"venue":null,"work_id":"c416b17a-1a3e-40ba-9231-e4e05d8457da","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.396490Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:90b3b96fcbacb7c2df18cabc5d97a4b5be4c53a22337d4ef5b6a584c2f290f13","observation_id":"c7e296e6-6dd6-4f66-80f2-e7c3471b199b","resolution":{"observed_at":"2026-08-05T17:14:37.979565Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-05T17:14:35.426238Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.426238Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b1ff2621666262a5f225fb5971299cfe8535878969f2dc7c84a6e735745e5af6","observation_id":"c9df8fc1-3cb3-4dd6-9ea5-56d2eb4caa54","resolution":{"observed_at":"2026-08-05T17:14:35.426238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.825924Z","title":null,"venue":null,"work_id":"6ad59cfb-c213-4e63-bea0-73af5f2b92da","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.476516Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:0ec59c75553ee56d8bbad76ec9d01f6f6ea3d23960ef8d3650b42dbc6c7fa74b","observation_id":"63e666b7-8336-4895-8673-a87533e6a8c2","resolution":{"observed_at":"2026-08-05T17:14:37.872632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.677683Z","title":null,"venue":null,"work_id":"eb359556-c24e-486d-b6d9-721ae9feb702","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.564905Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:16c407a7df53dd65e2f1eaa7f5bbb63428cbc83e3a7157d59662f5002fe7611d","observation_id":"dc2b557e-5b86-49fe-9ff5-8c346e752010","resolution":{"observed_at":"2026-08-05T17:14:37.755942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.453091Z","title":null,"venue":null,"work_id":"aa757358-1a6a-4486-8086-d807b4d1fcf8","year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.627803Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:69cfabb9f440d9522ec057c5e2dbcb23885e5ea4e814877333162aa72e374417","observation_id":"528f9768-6ae8-4c8d-b956-8d65b94e6c81","resolution":{"observed_at":"2026-08-05T17:14:37.545512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.275477Z","title":null,"venue":null,"work_id":"6992c737-4d1e-4c46-a17e-3553542cfe93","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.713718Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:5112419c447baf7b97e883a827c27ec720cac03e0700669d186d588ab2fdcbeb","observation_id":"69df6b77-0b1c-4171-a981-a772f91c5605","resolution":{"observed_at":"2026-08-05T17:14:37.318867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.117342Z","title":null,"venue":null,"work_id":"15f215a6-bb65-4c4e-b909-a5707a3e97cb","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.757257Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:1465d16e87ebb616e4e5ff1a0288b9f6ed9fabe9a8cf9b71ab64c5bb38e5bd35","observation_id":"9603b6b4-77f4-4619-ac81-67628d51d4a5","resolution":{"observed_at":"2026-08-05T17:14:37.167515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.933665Z","title":null,"venue":null,"work_id":"b9e4705a-dc13-4ce5-8f2e-ef9130614069","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.806693Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b767f7686d68aed7da78138f9bc658e506512bd06c67d5acd2b6d043f2435674","observation_id":"db73879b-b075-43f7-83d4-4827f105dc55","resolution":{"observed_at":"2026-08-05T17:14:37.029888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-05T17:14:35.899461Z","title":"N.; and Lopez-Paz, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.899461Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:4088063f575ff051b2279f41386abfbdb5652de39c594e392fba8d81fa47a9c3","observation_id":"3cba4f76-9c4a-49a8-9770-d18a92b36b57","resolution":{"observed_at":"2026-08-05T17:14:35.899461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.784409Z","title":null,"venue":null,"work_id":"8043cc2b-4c1f-4515-9a6a-ca068b734402","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.948619Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:3b61bab024c9557a3d6a88278e2f38a8db9e2d595664b6163f912a9d283d95ff","observation_id":"fb449c02-21f5-4c95-8e0e-d91346fb0ffd","resolution":{"observed_at":"2026-08-05T17:14:36.874015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.661210Z","title":null,"venue":null,"work_id":"4f2e41d4-bdad-48f3-a805-fb303d993361","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:36.026805Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:cace7b5acf193afab4b65a71515f385d89e49bc5161ddd1a8c9cd775be2d6bc9","observation_id":"fdaff4be-467f-4ef6-93e2-ad1eb90d52fe","resolution":{"observed_at":"2026-08-05T17:14:36.727202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 7 inbound Pith citation observations for arXiv:2509.00039."}