{"as_of":"2026-08-20T06:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee3d2a76c1a395c0af2aadb168de84bada49aacc3565fd39b72eeb6c6319f099","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T18:12:35.617577Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.19882/citation-record","integrity":"/paper/2606.19882/integrity","json":"/paper/2606.19882/citation-record.json","paper":"/paper/2606.19882"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Network dissection: Quantifying interpretability of deep visual representations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:3ab7b48d288c75a4fca57d31bad98d62677418868c630b25d97cacce2bee7f5f","observation_id":"20f49d24-095c-4e34-866a-3367cb7fc7f2","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Interpreting clip with sparse linear concept embeddings (splice)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:3e68c8b99380fb5f8294673e1a560a2eadfb0870465139ecd59cd10b2746b5c1","observation_id":"786c37db-1348-49d8-a306-6cd53961f931","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Language models can ex- plain neurons in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:e2dac8248d27fb45b58988bc787260bb66ac572f9a4e15428a8737916d9243c5","observation_id":"e1162b8e-a477-4b06-8867-c28366d6b7d2","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:add6f5527398c73b779fc800389772379fc79ad318668ed81f2c5e100fe5a25b","observation_id":"e912fc3d-f3f7-48c8-a82e-bf4b3f7a3f55","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:4ed29865c01320d2b9534702a5e0d96ead0dd4d5830c7db529719a7fe00752f5","observation_id":"3d6c4c0d-3430-4b5b-af45-41823ab36b30","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Conceptual 12m: Pushing web-scale image-text pre-training to recognize long-tail visual concepts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:09ef0db3bb1c80e2311ed61a9f900e70c403994a507cfb590880b51475c7467b","observation_id":"4c596c10-f0ce-42c2-9145-de8fbd135ee6","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14097","last_updated":"2024-12-18T17:47:46Z","snapshot_observed_at":"2026-08-18T14:45:21.838239Z","submitted_at":"2024-12-18T17:47:46Z","title":"Adaptive Concept Bottleneck for Foundation Models Under Distribution Shifts","version":1},"cited_work":{"arxiv_id":"2412.14097","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.14097","snapshot_observed_at":"2026-07-04T03:19:30.857615Z","title":"Adaptive concept bottleneck for foundation models under distribution shifts","venue":null,"work_id":"60c4f412-7677-4bc6-b8f2-f9a7c141b726","year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"cited_paper":"/paper/2412.14097","citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:ef7b39f618933f902ac2c780507d0ce080aa8cb70507b631bf10c3a0841b9f04","observation_id":"3c2ad9e0-01c3-4b63-a11f-aae6ec636a44","resolution":{"observed_at":"2026-07-04T03:19:30.859785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:795c7b9701b4ed369df74d9f8849412f861999645e6920e1ffea453a003981cb","observation_id":"8b4a94bd-e12c-462f-98dc-9c77992c0582","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:baede30b14aa2818a13a6f38defa22d79b294ddb2b12b705f6748c03c9f0f43c","observation_id":"98937f8a-fb05-401c-9a52-4f54dbc7841b","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Multimodal neurons in artificial neural networks.Distill, 6(3): e30, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:1372f5c1168df196159d7bfbd0be085be6a30486363c3bd8c87da53b6482b153","observation_id":"6d0d2a1a-01ce-4053-a041-b2c715346f01","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Natural language descriptions of deep visual features","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:2c0c33664b1dea25270947757c105f3942ab5007aaea90798edb03a175b9561f","observation_id":"2a4353b4-a152-4b83-ae13-aeb6dba0f39a","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:246d66795489ddafc1a1f2a671a30e7317cc4dec28dd8d0235b55f59a842eb6b","observation_id":"1f049e0a-0796-43dc-9359-0c572b3a77c6","resolution":{"observed_at":"2026-07-04T03:19:30.863434Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Identifying interpretable subspaces in image representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:79323dede32aed1fc72f68f7f7eac19305bb58f85dff2fedc7225ff9a6e0fb0a","observation_id":"0e06bde5-2d22-49be-862f-35b7279d582e","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13346","last_updated":"2023-04-26T07:36:03Z","snapshot_observed_at":"2026-08-16T15:37:38.016291Z","submitted_at":"2023-04-26T07:36:03Z","title":"Concept-Monitor: Understanding DNN training through individual neurons","version":1},"cited_work":{"arxiv_id":"2304.13346","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.13346","snapshot_observed_at":"2026-07-04T03:19:30.869835Z","title":"Concept-monitor: Understand- ing dnn training through individual neurons.arXiv preprint arXiv:2304.13346, 2023","venue":null,"work_id":"01ed247f-cefa-4f12-8081-d5a7f0e0cc2c","year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"cited_paper":"/paper/2304.13346","citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:518e885d14d4442d5ac0e0550f03ed3f28c1137f3c9666ca50a04cb2ca81b97a","observation_id":"fb36a0d3-ed76-4642-baa1-e0dc3537770c","resolution":{"observed_at":"2026-07-04T03:19:30.873089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:f48bea73cb0d6df7b3d6799e02fe90853697a7462cb4bc1b42957d1cfdd9dbb1","observation_id":"1026044e-a780-427a-90b8-65e1cded4668","resolution":{"observed_at":"2026-07-04T03:19:30.876576Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Concept bottleneck models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:a806a2f3bb864503f1440e03e9e71f962336f33df793c1a392c796940c1e66e0","observation_id":"0db8b6f7-241d-41d0-92df-579fd6a19d66","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:0630d1c45a0564aba849b80b8f40ef22329fe088e5ed1f6c147419568389e90e","observation_id":"66d17cb6-32f3-44e7-bc41-f3ca952a153f","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Scaling language-image pre-training via masking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:a3ebf1b582c580919defc278067bef299aeff991e36a22d8d4ca599fabe1e28f","observation_id":"d19324bf-993b-4a6e-93e0-10826f681886","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:f1880665a512348976e982a64863276105d3e3b64945f661f5151435960ec35d","observation_id":"a307b0bc-5537-410f-85d9-c8089b7f9ba0","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Visual classification via description from large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:1c7633f8db7646850aac058ff08a5714863ca7260772b746a34532173133cabd","observation_id":"db67e001-86c2-4f64-9ed9-560c02826816","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Scaling open-vocabulary object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:5ba90a1c22f25d56b927ec32063c1e14f67eecc14ce278a9168b2f4d6403abcf","observation_id":"c1e0ebfd-a827-4103-b64c-915e5fdc0cdd","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Clip-dissect: Automatic description of neuron rep- resentations in deep vision networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:d97b43aa830df72312e7e3acc6d1d30336235ecec5412bef74d276e4807e7083","observation_id":"a55da609-936c-498b-91d3-a4ea19789db5","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Linear explanations for individual neurons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:87da897d6e13e1b8155e3f2f8e295c57d3087f43e0e85b99d854e45fd11c74ea","observation_id":"ea735189-74e0-45cd-9475-b17a85b97666","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Label-free concept bottleneck models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:75b8a975a5f9995c47655d75bc95c45a54eeef9270ed8c95c25a9398f66b1c41","observation_id":"fa4fdee1-cde5-454c-9c50-824a08a101f5","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Cats and dogs","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:2cf655298c38e03925e07ab76ce807b8ff817ed107e1daaebad59a692f9c102f","observation_id":"ef33ff8c-4deb-45fd-851e-3aa242f00939","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:eaacb2666b54742259190f47dd810cd8a24e583618e7fc4ce730301499a2538f","observation_id":"7a1e356e-1016-4961-a95d-8e8c61bcb74c","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"A multimodal automated interpretability agent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:51793c52be7416da814647ca9db7419789f3d11736ca7ae75e05f5a4feb4ad76","observation_id":"c964e39e-0e76-472a-81d9-e7bae10472e0","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Incremental residual concept bottleneck models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:6e64b031cfd72ed6900e0c322a4d72b9abb3fa82ee2017d4a4f5dccc896b0e1f","observation_id":"b41816cd-aafa-4edb-87aa-e27d22deee34","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Vlg-cbm: Training concept bottleneck models with vision-language guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:5bed66690ee7e282ec9c5200933489549ced51ec9772cca0306b1b4d7214f121","observation_id":"8a05bce4-3f27-4a00-8ed3-498a205d995c","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Concept bottleneck large language models.ICLR, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:3991c976bb2be9fe30cbb2389951ef642a9b65193b626da469e6fb55040f40e0","observation_id":"e2dd615e-4616-49a5-9810-3d90b6d4c4c3","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-08-16T07:24:08.156932Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":"2303.15389","doi":"10.48550/arxiv.2303.15389","metadata_source":"pith","pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","venue":"cs.CV","work_id":"0c16c250-fd0f-446a-bbb0-ea8dd0ba5ccd","year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:557cd1be419ba6fd17f0bc451b2a9ed07fa85d9de5e892709212f7018a95d532","observation_id":"f83c3dc0-245c-4887-a12f-98279715968d","resolution":{"observed_at":"2026-07-04T03:19:30.880293Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:9d35500cff200d3985eba04a2d026b95b51aa35e9ccc696963485149b162073f","observation_id":"f04f4d69-635f-41fc-ad77-5074ffe9f096","resolution":{"observed_at":"2026-07-04T03:19:30.867589Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:25c252b6bea8c94a3a68139f39081e6771ae48f231b47ac3b0e6069166bed318","observation_id":"99c61470-4c20-4a3c-a99e-54686365482a","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Transformers: State-of- the-art natural language processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:e1c771be1421c6ff4331a9c82c867ed892e5749c8b35aeed9bb542949a8344bb","observation_id":"8b9f6768-1828-4e28-b7cf-ca7e769cef23","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Learning concise and descriptive attributes for visual recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:451f848893bec1b59231b836df16463881c280d12e2df848b6cc231bd352ad58","observation_id":"268141d5-7009-44e5-9ede-7d82e9526ec4","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Clip-kd: An empirical study of clip model distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:138e7e066250dca55f5c713894795cbeb19cecefd57298f231a2ba5b66a77e7f","observation_id":"663ab755-1748-43ec-9fd7-0daa699b4a7e","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Language in a bottle: Language model guided concept bottlenecks for interpretable image classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:272d4f6af514c23cc4a5375ad71489c0ac42f0afc9d2a0988dbe0a46b32b1fd2","observation_id":"3762ca69-ff99-43a5-a062-dabd90e1f0fb","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Post-hoc concept bottleneck models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:eebffd0a9220545db4dabd2f567f51b2203eb6124ee0cbad5b77b404d4190b64","observation_id":"d03897b8-3aa3-4689-9d60-ab40acae242a","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:752da1884f8cc97e80252443b6ccb308550ff1bdcc9cfb8c7fbe645726a2bce9","observation_id":"4b863f4f-148c-4e6e-b446-91dd09093298","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:a60946421b2d9e15b58ebfef335428d1df8c74cd5bc33b50380e8eeffc7ad460","observation_id":"1e5f2b45-7930-4bb1-948d-181a7e9c422b","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"Similarity is measured via cosine similarity in a joint text embedding space, combining features from the CLIP ViT-B/16 text encoder and the all-mpnet-base-v2 sentence encoder","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:4a40836a1745aa7c0ae6cd8f3fab0d44abe5e706489548350649eda43462470e","observation_id":"35b20cca-72eb-4ce4-9131-3351e6506e32","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"If I had to describe this image using only one sentence with the words class, it would be:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:1a7de8cfc38cd456e7f706b530ec6f0364d8d80a9863f1cd6ee4655cadab3378","observation_id":"41f79a20-8b01-4841-9642-dc253be217c2","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"By removing negative values, we avoid this ambiguity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:1807cb9ba59d517b67fc5a7e48d096a7cf76e4c17847981fc9fd32546d793417","observation_id":"91fb40ee-8073-4fb9-b410-09f62bd5b5f4","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"By zeroing out irrelevant (negative) dimensions, we strengthen the contribution of mean- ingful concepts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:3908ff208b89675bfb51863c1ab72a3b5af436ca7691fffaa241d486b71c3a8b","observation_id":"b955e9cf-4e16-4c69-bcf3-3b6d65407fb5","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T18:12:35.617577Z","title":"barbershop","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T18:12:35.617577Z"},"links":{"citing_paper":"/paper/2606.19882"},"observation_digest":"sha256:752e399a723f79be27bc922d30d05b5d404ef9c99c4f6fa78ae841856ae473dd","observation_id":"c505b7d4-13db-40e7-bee3-17d50e7a121e","resolution":{"observed_at":"2026-06-26T18:12:35.617577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.19882","last_updated":"2026-06-18T07:41:50Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T14:46:09.499576Z","submitted_at":"2026-06-18T07:41:50Z","title":"Multimodal Concept Bottleneck Models"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2606.19882."}