{"as_of":"2026-08-12T18:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:defd822543884e45916504524812fcbd1045b0e76236e2488ddf12c542cecaeb","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:19:29.070092Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T02:07:27.600563Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T18:25:57.505603Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"cited_work":{"arxiv_id":"2501.13341","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13341","snapshot_observed_at":"2026-07-01T18:25:57.505603Z","title":"arXiv preprint arXiv:2501.13341 , year=","venue":null,"work_id":"badc997c-38c6-4427-ba09-1f3b41a256be","year":null},"citing_paper":{"arxiv_id":"2606.27527","last_updated":"2026-06-25T20:19:50Z","snapshot_observed_at":"2026-07-07T00:01:44.678954Z","submitted_at":"2026-06-25T20:19:50Z","title":"Large Language Model Teaches Visual Students: Cross-Modality Transfer of Fine-Grained Conceptual Knowledge","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-29T02:07:27.600563Z"},"links":{"cited_paper":"/paper/2501.13341","citing_paper":"/paper/2606.27527"},"observation_digest":"sha256:554314194f5452e62c419379b50efe99719b98d8e4ea30afc1d14a463bfee4bf","observation_id":"169e2075-9a3e-44a0-b930-a594ad1de2eb","resolution":{"observed_at":"2026-07-01T18:25:57.507270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.13341/citation-record","integrity":"/paper/2501.13341/integrity","json":"/paper/2501.13341/citation-record.json","paper":"/paper/2501.13341"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T16:19:28.905738Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.905738Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:6a3adaec660fb56be47a644f86fc6b932e32cb07ab3d9941e04377bc429f1ff8","observation_id":"87192714-0c32-49c2-b591-ad57c5f36454","resolution":{"observed_at":"2026-08-10T16:19:28.905738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.910453Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.910453Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:05727980460bb8f62d679d95abc6f565488cf5dc7ffd46374016a67b928bafa8","observation_id":"41a94c60-5d80-4d35-afef-6e9035f9f320","resolution":{"observed_at":"2026-08-10T16:19:28.910453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16410","last_updated":"2023-06-28T17:57:10Z","snapshot_observed_at":"2026-08-12T11:22:04.135857Z","submitted_at":"2023-06-28T17:57:10Z","title":"Towards Language Models That Can See: Computer Vision Through the LENS of Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16410","snapshot_observed_at":"2026-08-10T16:19:28.914427Z","title":"Towards language models that can see: Computer vision through the lens of natural lan- guage","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.914427Z"},"links":{"cited_paper":"/paper/2306.16410","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:26e9ec5519f8d4dfcdae7e402458d22cfbc39544511f4407b64e3e38c8ced865","observation_id":"b4cd63d5-89b2-4ca3-81d8-c1d3e467b73c","resolution":{"observed_at":"2026-08-10T16:19:28.914427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.600241Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":"1d25c299-a4b7-4e2b-9d60-a7cf7dd9f93f","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.919178Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:93a46347d0a4d1927f8d4c442c2410d55b3df73c89885e3ac76e9741860106b3","observation_id":"bdf7d593-e399-45a9-a1c9-6aa776019d63","resolution":{"observed_at":"2026-08-10T16:19:29.604668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.586269Z","title":"Describing textures in the wild","venue":null,"work_id":"e0e3e259-518e-4aa7-bd6a-f251beb45655","year":2014},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.924572Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:af02a73087035990d5cc9c4efea18a298ae65d671bb3cd3ccecb54d9680ab022","observation_id":"8f4a13e1-d3ff-4d04-867b-0f2303c63869","resolution":{"observed_at":"2026-08-10T16:19:29.590953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.573806Z","title":"Learning gener- ative visual models from few training examples: An incre- mental bayesian approach tested on 101 object categories","venue":null,"work_id":"fe05bf9d-8e5e-46c9-b85e-85a0fa12cc1e","year":2004},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.928836Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:8854daebac1ab7b1655cef8a79359acb5f04ea7bbb552dd772d6a9a0c1dcf9db","observation_id":"90193cc7-2f14-4385-ba25-0219b275249d","resolution":{"observed_at":"2026-08-10T16:19:29.578373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.559972Z","title":"From im- ages to textual prompts: Zero-shot visual question answer- ing with frozen large language models","venue":null,"work_id":"0f38115a-1d6b-4585-ab53-53d38f55c4cf","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.932652Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:107d919ffd6d822d89399dcada1861762f54bd8c8be303a37f3d4eb0305568fa","observation_id":"d45094b3-47f0-42f0-b65e-5b4c3cb6b06d","resolution":{"observed_at":"2026-08-10T16:19:29.564390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.544035Z","title":"Class attention transfer based knowledge distillation","venue":null,"work_id":"df056499-9fd4-4a73-9e18-79ea61f49c16","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.936567Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:37adb3f4877e5c8651586a59e303a6f667d2a348370f09cc99b570855620e122","observation_id":"db16b673-b6df-4639-933f-a3240ac90355","resolution":{"observed_at":"2026-08-10T16:19:29.549160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.940489Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.940489Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:2f673f24a5d4a7a4ad5f3312f423e96bf1045fdfd7f9bfbc54be4eac27ff84ca","observation_id":"9ef32812-2014-4c1f-9f24-1eb6a295b55f","resolution":{"observed_at":"2026-08-10T16:19:28.940489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.518863Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"da4e80e2-7030-4eaa-b643-8c05fbcc601b","year":2013},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.944045Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:ad271c9dad303597ce1c071b62535aa9357015d0021a88e9eb06c0683f50b0e0","observation_id":"b97a64d7-33b3-4e3a-a0af-0e77e40fe2a7","resolution":{"observed_at":"2026-08-10T16:19:29.523140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.947671Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.947671Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:27fefc969383c1c0938b5cfb5500b74fb80e3ddd5afe0fc653643bce889ccd78","observation_id":"5460466e-e62f-4831-8646-3abde2e8dd95","resolution":{"observed_at":"2026-08-10T16:19:28.947671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.494302Z","title":"Feature pyra- mid networks for object detection","venue":null,"work_id":"05e5c426-5c26-46cc-a998-4204709a081b","year":2017},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.951432Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:ceb16f599d5a12a31a00d17410642f4599b183e19b0ac121d506633d7ef6322f","observation_id":"4403aaf1-55cf-4307-8c29-0b362132b9a1","resolution":{"observed_at":"2026-08-10T16:19:29.498469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.480297Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"39f14b85-9961-4865-8230-73135928e5f9","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.955955Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:f42fde7a65eecbfa594267d3702f1dd47b2d0fb3cd2108b50042c4823f0edb69","observation_id":"20f2c352-564c-4514-9b09-cbb207d03cd1","resolution":{"observed_at":"2026-08-10T16:19:29.485383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.959587Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.959587Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:00473554bfecdb9a8b5c0953521527a4c872ca070f4a7aba809496395b0508cb","observation_id":"377ad3b4-9532-48fd-9732-1b7d67742ba7","resolution":{"observed_at":"2026-08-10T16:19:28.959587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.962651Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.962651Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:b1d57ec5e852bb58c140784adbbd0093dc9bea6027a14514e831868e92068af2","observation_id":"34b1547d-67f7-4160-a2e3-0a67db4e2744","resolution":{"observed_at":"2026-08-10T16:19:28.962651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.452537Z","title":"Annealing- based label-transfer learning for open world object detection","venue":null,"work_id":"9f3851fc-17c4-457a-97b1-a5cccff358ec","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.966063Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:8fec2e68842557c1543354cf2a74356b1c27c839cadf675dbf3f98691aafd128","observation_id":"50344ca4-da0d-40fc-8941-aff0c7d2200d","resolution":{"observed_at":"2026-08-10T16:19:29.456617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-10T16:19:28.969633Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.969633Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:d9f032b70c078064c1ebe4e126208aa14aead69fb1929ee7e95245157290105e","observation_id":"63523cf7-ef10-4ab3-bea6-bfa327d99607","resolution":{"observed_at":"2026-08-10T16:19:28.969633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07183","last_updated":"2022-12-01T17:38:37Z","snapshot_observed_at":"2026-08-08T07:53:13.926951Z","submitted_at":"2022-10-13T17:03:46Z","title":"Visual Classification via Description from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07183","snapshot_observed_at":"2026-08-10T16:19:28.974014Z","title":"Visual classification via description from large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.974014Z"},"links":{"cited_paper":"/paper/2210.07183","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:5cbfd663081b9dd29450c058d3b5f39940c1f3a7774e3b08670c3ec94141d81e","observation_id":"6c6d9aa8-c2d9-47fa-b682-8f83f4d782bb","resolution":{"observed_at":"2026-08-10T16:19:28.974014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.440099Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"cd0f6dd6-d570-4769-8d68-a0ee540cc77b","year":2008},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.977936Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:5e3239831b0e1d3caf963831cdeaf7c1931668df928fa2df9a95a94663e75955","observation_id":"78c58dc4-fb9d-4647-bc35-d1e1a7c474c8","resolution":{"observed_at":"2026-08-10T16:19:29.444800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.427039Z","title":"Chils: Zero-shot image classification with hierarchical label sets","venue":null,"work_id":"06a244e0-1439-4ff1-8ed2-49b86c39839d","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.981783Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:5ad13031213721d8d72fd02a5b3ed76e3ed769a62acf6ad1666c0e5d6ad4248a","observation_id":"bf37bc1a-acb4-4f0b-b50c-0162577748c6","resolution":{"observed_at":"2026-08-10T16:19:29.431265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.413175Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":"1f185599-f57b-48d3-9477-b9f87eae7015","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.985433Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:d233809e0467c59abf6dd4f9bc41d4a2ed9f5bc3181b7aaaa235cab024bbc0ca","observation_id":"e4614a99-4e96-4517-8e13-25d437dc070e","resolution":{"observed_at":"2026-08-10T16:19:29.418047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.399798Z","title":"Cats and dogs","venue":null,"work_id":"dc243d31-37e1-40df-99e5-667a8234bfaf","year":2012},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.989574Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:b9c34a408c735dd5c4e4c86b46793569fdb321516c7569b900ff3296c5b31400","observation_id":"7959c138-c6b6-4821-866c-2b88918ad4fa","resolution":{"observed_at":"2026-08-10T16:19:29.403759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.993593Z","title":"What does a platypus look like? generating customized prompts for zero-shot image classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.993593Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:98bbe2f4d7fa3ad12680bc370085e9eadffba9a68743ff3b0b281ae9e966c1ee","observation_id":"a2b34a0d-42ff-4947-966c-bf54e5a8445f","resolution":{"observed_at":"2026-08-10T16:19:28.993593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.380109Z","title":"Optimization as a model for few-shot learning","venue":null,"work_id":"d9e84780-0124-4be1-aad8-e693867059c6","year":2016},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.997174Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:3c7047a76ef9254f284e1a664cbad01e8fabdbd65799a4efecb6ff1c790f8dc4","observation_id":"5153617c-8f02-41d6-9059-eab7e64b3297","resolution":{"observed_at":"2026-08-10T16:19:29.384413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.001068Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.001068Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:765395b3f5c454020c4b1f952d2b51d5254f0cec98ca6ece9af2bc4713219d0a","observation_id":"f8d8ff93-1720-4098-ba99-181776a97735","resolution":{"observed_at":"2026-08-10T16:19:29.001068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.01628","last_updated":"2021-11-02T14:41:11Z","snapshot_observed_at":"2026-07-06T12:04:39.450849Z","submitted_at":"2021-11-02T14:41:11Z","title":"Human Attention in Fine-grained Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.01628","snapshot_observed_at":"2026-08-10T16:19:29.004633Z","title":"Human attention in fine-grained classification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.004633Z"},"links":{"cited_paper":"/paper/2111.01628","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:f0f283c390cd1c20d3e214fbb8e35a459e52c780d31c5af17a9cb5ac37aedfeb","observation_id":"c503dbb7-ee66-4203-8f69-81be1e142b43","resolution":{"observed_at":"2026-08-10T16:19:29.004633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.361587Z","title":"In-context impersonation reveals large language models’ strengths and biases","venue":null,"work_id":"d01fc9d1-5f42-4f83-a69b-64033a2a2544","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.008742Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:6656599b2b31e92367ddce6934c94c3ed71c083633c6be9f53e46b630f4b4afc","observation_id":"a7117520-d90b-44ba-816a-bcf97ba05efd","resolution":{"observed_at":"2026-08-10T16:19:29.366112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.012301Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.012301Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:1ec554858387dfe50e31ac2d91dca92532fcd0a40213a82f8cdb7c4b63541b5e","observation_id":"31f42e38-9f16-4581-b91f-7b5d5762bffd","resolution":{"observed_at":"2026-08-10T16:19:29.012301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.342246Z","title":null,"venue":null,"work_id":"8b954312-f69b-4094-b632-c077b5cf1e7e","year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.015958Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:d709d0c7cb6de33c1cdb6099549bcdc1d9867494a854ee3ca54529b4155f1851","observation_id":"6928faf9-5b6e-461a-9c0b-00ef4dbb3974","resolution":{"observed_at":"2026-08-10T16:19:29.346166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.328928Z","title":"Fastvit: A fast hybrid vision transformer using structural reparameterization","venue":null,"work_id":"c4ebe481-c7ac-4da9-ae6d-7ea5cd0717c2","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.019474Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:3c27727849e1ce2a96fe3596e32d04926442d24568ceae0dfd9d348dfc613a96","observation_id":"c3124c18-82cd-4b81-8871-a07ffbf7ac39","resolution":{"observed_at":"2026-08-10T16:19:29.333768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.022975Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.022975Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:4d850ab387a4e6da721eb5cc1f09c6dc9f74d3a99bada418a27247a8b1f23d1f","observation_id":"eb734600-36a7-4062-90b6-31ff4a4b9d10","resolution":{"observed_at":"2026-08-10T16:19:29.022975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.309225Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":"15e3bffc-a0bd-484a-95a0-d7063c4953f0","year":2011},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.026811Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:685c5258527f0ab2eaa9df7940d931eb0d6422480774aaa0d8094f973f672e10","observation_id":"22dd06de-e136-421d-b496-a2a53cf7856c","resolution":{"observed_at":"2026-08-10T16:19:29.313427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.295614Z","title":"Bi-lrfusion: Bi-directional lidar-radar fusion for 3d dynamic object detection","venue":null,"work_id":"8d1de9bd-67f9-4620-b348-1a4b0058ddef","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.030281Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:5e4116692f24a3474457bd16be1467ed248a2bf316e23bb3d0cb03b769a7e30c","observation_id":"57186486-171e-4f14-a877-244491928662","resolution":{"observed_at":"2026-08-10T16:19:29.301104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10904","last_updated":"2022-05-15T23:20:46Z","snapshot_observed_at":"2026-08-06T05:59:00.316195Z","submitted_at":"2021-08-24T18:14:00Z","title":"SimVLM: Simple Visual Language Model Pretraining with Weak Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10904","snapshot_observed_at":"2026-08-10T16:19:29.033903Z","title":"Simvlm: Simple visual language model pretraining with weak supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.033903Z"},"links":{"cited_paper":"/paper/2108.10904","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:999b3a66c8e21511536b2231fe27f58d4e2a8898163b4160243dfb4a34d13473","observation_id":"8631da16-cc6f-4f78-b72b-077e1824f250","resolution":{"observed_at":"2026-08-10T16:19:29.033903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.283191Z","title":"Fine-grained image analysis with deep learning: A survey","venue":null,"work_id":"b22873b4-b36f-47d7-976a-ab8521eac1b2","year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.037673Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:ff03e05f83157820e0bc58fff5f916b35c0d3709a130f3de49514d52efb4aa6e","observation_id":"da451358-4637-4d83-a448-b63dbded10db","resolution":{"observed_at":"2026-08-10T16:19:29.287347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.269918Z","title":"Aligning bag of regions for open- vocabulary object detection","venue":null,"work_id":"3f5b9ac6-7595-4991-bac3-943b74c91e2e","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.041714Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:c9a9324085a9e34d25889ccf658873c6b8ac211e6fb31267909d59913d6db928","observation_id":"e28e0839-e736-4add-b77c-60dc70bebbb6","resolution":{"observed_at":"2026-08-10T16:19:29.274985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.045302Z","title":"Learning concise and descriptive attributes for visual recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.045302Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:4f1d7ee1d61e021e4eb39e4055d7d8ddea908b38aa3aebfcf89394549c634f83","observation_id":"a89f0db4-f30e-4cf1-89f5-24fed1d92ff2","resolution":{"observed_at":"2026-08-10T16:19:29.045302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.246639Z","title":"Language in a bottle: Language model guided concept bottlenecks for interpretable image classification","venue":null,"work_id":"316fd961-8307-4d15-952b-11ce4212f90c","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.049001Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:8b52137c87980d9dbc791c2bfa05396abe69d4c5986488f11dc3a985f5b354dd","observation_id":"d5d9f91a-5ba8-444c-a1df-1e969abad942","resolution":{"observed_at":"2026-08-10T16:19:29.251103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.232532Z","title":"An empirical study of gpt-3 for few-shot knowledge-based vqa","venue":null,"work_id":"2059c4f5-aa50-4841-a2a7-b090c886bb09","year":2022},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.052489Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:6e88d357a44d08add75337a4bf36ac649457b451c00b7ca5e96ac9768be07fc7","observation_id":"fe40967f-f5f6-41d5-a55e-ffd2a190c72a","resolution":{"observed_at":"2026-08-10T16:19:29.238072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-10T16:19:29.055832Z","title":"A survey on multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.055832Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:29f1142612a74c7472bcc6f7b6c98d061610d9583c437dc8c202c4b7c0896c0c","observation_id":"df4f2b3d-11ad-4faa-837a-f3624eaf9934","resolution":{"observed_at":"2026-08-10T16:19:29.055832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13601","last_updated":"2024-05-28T05:36:23Z","snapshot_observed_at":"2026-08-10T21:32:36.140961Z","submitted_at":"2024-01-24T17:10:45Z","title":"MM-LLMs: Recent Advances in MultiModal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13601","snapshot_observed_at":"2026-08-10T16:19:29.059340Z","title":"Mm-llms: Recent ad- vances in multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.059340Z"},"links":{"cited_paper":"/paper/2401.13601","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:1e5538d55da7d67b71a4e96897ebf45c1d46d5095732749808898f78b6ade562","observation_id":"5c24d812-e8ed-4e52-9351-5fdb11cff0fa","resolution":{"observed_at":"2026-08-10T16:19:29.059340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.062776Z","title":"Vinvl: Revisiting visual representations in vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.062776Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:f13d39afc2ad5aceab1e527f7e30ebb5eec0959f4e035262f618130471387876","observation_id":"4284d516-f62b-4318-b664-717dd7437b79","resolution":{"observed_at":"2026-08-10T16:19:29.062776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.212458Z","title":"Decoupled knowledge distillation","venue":null,"work_id":"6a26dcf3-b67d-47ee-8691-81010f0252ab","year":2022},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.066539Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:4f5c7a9f88d157c5c2cd3070721b94062a3b26e71a64e65ea4c92a9b90e4940c","observation_id":"9b2c88ef-3885-4963-9a3f-1eadccb5281b","resolution":{"observed_at":"2026-08-10T16:19:29.216540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.197853Z","title":"Biformer: Vision transformer with bi-level routing attention","venue":null,"work_id":"9d5195fe-281f-498a-a628-9d54a2fafa17","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.070092Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:06d18624db5a3e6be808ec3c33c164a31e4ef9d39299302f45b90675cb9e9b06","observation_id":"5fd768fd-1861-4abe-856f-cdbdb0bd9fc8","resolution":{"observed_at":"2026-08-10T16:19:29.203688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T06:15:23.903657Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2501.13341."}