{"as_of":"2026-08-23T12:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6e53b913c102cf4623cdcc638eb1c48853f9fd568e8cc7275364ee77df9d25e","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:12:58.172261Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:35:03.349259Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T17:35:03.450625Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"cited_work":{"arxiv_id":"2501.09221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09221","snapshot_observed_at":"2026-08-15T17:35:03.450625Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","venue":"cs.CV","work_id":"7016575f-4f54-4c51-95ac-dff426d15c05","year":2025},"citing_paper":{"arxiv_id":"2508.08966","last_updated":"2025-08-12T14:31:22Z","snapshot_observed_at":"2026-08-16T10:03:11.653589Z","submitted_at":"2025-08-12T14:31:22Z","title":"Integrating attention into explanation frameworks for language and vision transformers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T17:35:03.349259Z"},"links":{"cited_paper":"/paper/2501.09221","citing_paper":"/paper/2508.08966"},"observation_digest":"sha256:9a56bd2c90098848ab6c399dc88203414037f524adb1989b6ec33727d057d1af","observation_id":"d069482b-01f8-4bcf-8cb7-08316db20626","resolution":{"observed_at":"2026-08-15T17:35:03.459622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.09221/citation-record","integrity":"/paper/2501.09221/integrity","json":"/paper/2501.09221/citation-record.json","paper":"/paper/2501.09221"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:12:58.350288Z","title":"Describing objects by their attributes","venue":null,"work_id":"7c5a8bfb-870c-4e3c-b110-aaf51a285f57","year":2009},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.140847Z"},"links":{"citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:6619c7cb9ff26b2f162cf26e4865e3851dba6ac3990048195742da183e8c20c4","observation_id":"1966fa80-2ed0-491e-949d-13af8a6fcf86","resolution":{"observed_at":"2026-08-10T20:12:58.355315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01778","last_updated":"2021-07-08T20:16:28Z","snapshot_observed_at":"2026-08-17T23:50:11.173365Z","submitted_at":"2021-04-05T05:26:29Z","title":"AST: Audio Spectrogram Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01778","snapshot_observed_at":"2026-08-10T20:12:58.144966Z","title":"Ast: Audio spectrogram transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.144966Z"},"links":{"cited_paper":"/paper/2104.01778","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:bbc7feaac4a390e5f1aa4ce9486cbd076ebe0f2f1189a1a87e507df126641112","observation_id":"2fc6978c-abd0-4474-91ba-1071b70ea112","resolution":{"observed_at":"2026-08-10T20:12:58.144966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.07197","last_updated":"2021-07-01T11:55:07Z","snapshot_observed_at":"2026-08-16T18:24:32.548314Z","submitted_at":"2021-05-15T10:33:35Z","title":"Are Convolutional Neural Networks or Transformers more like human vision?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.07197","snapshot_observed_at":"2026-08-10T20:12:58.153980Z","title":"Are convolutional neural networks or trans- formers more like human vision? arXiv preprint arXiv:2105.07197,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.153980Z"},"links":{"cited_paper":"/paper/2105.07197","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:c3cf15b1f122cbea3b0532dbb35c1a6717ea18beb2d0370c38dc3bb178798fc8","observation_id":"2af4640b-0220-4526-a915-86b3be921b4e","resolution":{"observed_at":"2026-08-10T20:12:58.153980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-10T20:12:58.163307Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.163307Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:c39cbb2a9dedc83705ba6be1769afd828e03674a47620b945cb8984ad2eb718d","observation_id":"1e30bcfb-b02e-4203-815c-e7bb59b0959e","resolution":{"observed_at":"2026-08-10T20:12:58.163307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:12:58.324563Z","title":"We set the patch size to correspond to 16x16 pixels","venue":null,"work_id":"433e86d8-15ef-44b3-b586-0572a86731c7","year":2021},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.168030Z"},"links":{"citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:c8bff8ce43b4e9a1d09e8f63d0791f6fd555dc64c6dd99b61e20669cf21a4ad8","observation_id":"1e9718b5-4a7d-4876-a0d8-8e6e79d6de7c","resolution":{"observed_at":"2026-08-10T20:12:58.328782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:12:58.311895Z","title":"The following convolution blocks consist of a single convolution layer of kernel size=3 and stride=2, as well as the batch norm and ReLU activations","venue":null,"work_id":"dce0a561-c8cc-4db4-9429-77490f6dc32e","year":2020},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":1029,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.172261Z"},"links":{"citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:5c983a553dbde887341e7472ad7be7678c408eaaca6ab5695b7387af4b233ad4","observation_id":"5aedb210-1e7d-4602-9b5f-bfde6765f8ba","resolution":{"observed_at":"2026-08-10T20:12:58.316300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:12:58.337212Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":"5314b4c9-5e3d-4a3c-859b-b445acd2dba9","year":2011},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.158392Z"},"links":{"citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:c57580f4bead98bc124990901266877660a80610548b3ed629136c84d2e91595","observation_id":"55785ad0-265a-4d90-a10f-99f7d97a28a6","resolution":{"observed_at":"2026-08-10T20:12:58.341517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:12:58.365675Z","title":"Image transformer for explainable au- tonomous driving system","venue":null,"work_id":"cc969b09-2006-42c9-beb1-4ba95a478a8e","year":2021},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.136626Z"},"links":{"citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:b7a148ca5f805990d6b943f6a9b312e8ddc3658052f904fc15d1131e97cf5d4e","observation_id":"febaf998-ae44-47df-9776-593b65b844ff","resolution":{"observed_at":"2026-08-10T20:12:58.370876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.08534","last_updated":"2023-02-13T15:50:22Z","snapshot_observed_at":"2026-08-19T14:57:47.082151Z","submitted_at":"2022-05-17T17:59:11Z","title":"Vision Transformer Adapter for Dense Predictions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.08534","snapshot_observed_at":"2026-08-10T20:12:58.127534Z","title":"Vision transformer adapter for dense predictions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.127534Z"},"links":{"cited_paper":"/paper/2205.08534","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:19cf7e2fac4303a2b1ca64bca5f789699d8fb88309ac809bbf990e4f93143dae","observation_id":"654f5a22-82c6-4486-a61c-88f8aa928c89","resolution":{"observed_at":"2026-08-10T20:12:58.127534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T20:12:58.131823Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.131823Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:8a55118f94c3e80313c6170442f486cbc53971d972ff32c150d6dc88073fef41","observation_id":"a742862d-fc28-4129-aaf0-71e73f46c555","resolution":{"observed_at":"2026-08-10T20:12:58.131823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-10T20:12:58.123392Z","title":"On the opportunities and risks of foundation models.arXiv preprint arXiv:2108.07258,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.123392Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:8e5672ec0cf7ce1d54f4652b97acf49573bdaf5c74c53efb2c62112544281e5b","observation_id":"d54e9a35-8411-4432-82d3-9ea3956193b6","resolution":{"observed_at":"2026-08-10T20:12:58.123392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03602","last_updated":"2022-12-26T19:42:50Z","snapshot_observed_at":"2026-08-19T19:49:57.207533Z","submitted_at":"2021-04-08T08:34:04Z","title":"SiT: Self-supervised vIsion Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.03602","snapshot_observed_at":"2026-08-10T20:12:58.118649Z","title":"Sit: Self-supervised vision transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.118649Z"},"links":{"cited_paper":"/paper/2104.03602","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:2b36ae4b390290457e254907ad067363f088793ddb3b820233a5936c7072662a","observation_id":"ec637453-89cc-459b-88f8-9e10cb04b1c7","resolution":{"observed_at":"2026-08-10T20:12:58.118649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00349","last_updated":"2024-05-05T19:11:25Z","snapshot_observed_at":"2026-08-21T05:12:45.402131Z","submitted_at":"2024-05-01T06:50:18Z","title":"A Self-explaining Neural Architecture for Generalizable Concept Learning","version":2},"cited_work":{"arxiv_id":"2405.00349","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00349","snapshot_observed_at":"2026-08-10T20:12:58.229659Z","title":"A Self-explaining Neural Architecture for Generalizable Concept Learning","venue":"cs.LG","work_id":"e85f241f-3b25-4f54-ba64-1e5864ef9421","year":2024},"citing_paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T20:12:58.149323Z"},"links":{"cited_paper":"/paper/2405.00349","citing_paper":"/paper/2501.09221"},"observation_digest":"sha256:386c3a12f36832456fbe38fbbd1b3374de11b48266de2ee79ae3577dff74e1f3","observation_id":"df43ab0e-c0d5-4cb3-aa0a-487c8a98c86d","resolution":{"observed_at":"2026-08-10T20:12:58.236527Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.09221","last_updated":"2025-02-03T19:53:49Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T11:57:37.441778Z","submitted_at":"2025-01-16T00:45:05Z","title":"ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 1 inbound Pith citation observation for arXiv:2501.09221."}