{"as_of":"2026-08-10T05:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e10fc2655b7df9ded128efa2ee91ea485085b4547d2e1c6f72d03d1186b4ad2f","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:03:48.913339Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05393/citation-record","integrity":"/paper/2608.05393/integrity","json":"/paper/2608.05393/citation-record.json","paper":"/paper/2608.05393"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.339162Z","title":"primitive","venue":null,"work_id":"2b767756-e4bc-4de1-b972-c108668b1792","year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.869981Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:d5329e88f0b93f71b39b253d2408d4f1051fdb8fc7ce55d099693abfba7e9b5f","observation_id":"007d7ace-e45c-4b6e-9618-0a166ce39465","resolution":{"observed_at":"2026-08-08T14:03:49.342326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.330125Z","title":null,"venue":null,"work_id":"8b57bf0c-d84b-463b-972f-1945fc5a03fb","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.873254Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:a7bc7afba9794e5764ff7300b6d816e3131afa62ac09ca013cf981e474d3f7c2","observation_id":"6886c918-f025-4bca-be45-9a8b6866294a","resolution":{"observed_at":"2026-08-08T14:03:49.333093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.321099Z","title":"primitive","venue":null,"work_id":"96e299c8-9c14-4687-bf4d-2b46c6ae89a3","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.876423Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:39e0ff47946181349ee35f8b721b1b2804ccbce63bbe03cafe4a56a2e9c98d68","observation_id":"a764c40d-b392-4f25-a717-ccb78d0af3b0","resolution":{"observed_at":"2026-08-08T14:03:49.324270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02937","last_updated":"2023-06-30T22:51:42Z","snapshot_observed_at":"2026-07-06T12:57:32.819460Z","submitted_at":"2022-04-06T16:55:41Z","title":"Last Layer Re-Training is Sufficient for Robustness to Spurious Correlations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02937","snapshot_observed_at":"2026-08-08T14:03:48.840262Z","title":"Densely connected convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.840262Z"},"links":{"cited_paper":"/paper/2204.02937","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:397028821e8a471c0db9c29e3c9ae3bb7925c2e4fb9596dea341638e74ffbe32","observation_id":"fba6afec-f057-4d1f-a089-a0f1e2f49260","resolution":{"observed_at":"2026-08-08T14:03:48.840262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:48.848201Z","title":"CDMask: Change customized mask architecture for change detection.IEEE Transactions on Geoscience and Remote Sensing, 64:5619919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.848201Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:c94ca50a4b81665ee769c0d31fffe2a42b0f08362dbd0feef9be29f1834b1f89","observation_id":"11093d44-0022-4b97-b171-99cb1296bf25","resolution":{"observed_at":"2026-08-08T14:03:48.848201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:48.861936Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.861936Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:8b03bbcf7ae4dcd9e2e802efc615433ca2f19cdced48d9423e80bb5828b5f433","observation_id":"5d09e578-76df-4764-ae29-2f035efb64e3","resolution":{"observed_at":"2026-08-08T14:03:48.861936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-09T06:48:42.729935Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-08T14:03:48.865549Z","title":"Extract-Once","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.865549Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:4eb2e11d1209fab9e703f75df767783d90c660be14140923955151ebe30d12e9","observation_id":"76517eef-6970-4d1a-ad27-f0ab7844e8e2","resolution":{"observed_at":"2026-08-08T14:03:48.865549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.312914Z","title":"Color is one of the most expressive and invariant visual cues, robust to rotation and scaling (Swain & Ballard, 1991)","venue":null,"work_id":"311b97a3-4afd-4bf7-a0ce-63dd1fa4fdce","year":1991},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.879958Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:2bfda786605ff45ff8bd744e6497fbe89cb51183ae9c719e6a2b068500f9ce51","observation_id":"1cb30ac1-91fe-49ba-88ff-70b4644f0f15","resolution":{"observed_at":"2026-08-08T14:03:49.315792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.304654Z","title":"Texture analysis is crucial for distinguishing materials and repetitive patterns","venue":null,"work_id":"0059beaf-ce1f-41da-99ef-2b87c4fb3eea","year":1996},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.882590Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:07456f76c371896771378ce2b85a8f0dda3abd9690d5f356652df026478e48fd","observation_id":"906e8e4e-50c5-4599-9ff3-85ca30dd78b2","resolution":{"observed_at":"2026-08-08T14:03:49.307572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.296365Z","title":"texture bias","venue":null,"work_id":"666ba8eb-99f5-4833-a87f-8703a3000c7b","year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.885471Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:b267c44039f926bd6baaa0c79f93a658b9ff10610d07413ca7f40f161d4a93f6","observation_id":"02e4a158-934d-4833-a596-e1f4af590d62","resolution":{"observed_at":"2026-08-08T14:03:49.299115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.287444Z","title":"Removing any single component results in an information void that the randomized prompts alone may struggle to fill (as evidenced in Table 5 of the main text)","venue":null,"work_id":"31c43414-0ea5-466f-bd31-342435b0ca8f","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.888017Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:e991c78a5a94999b14a6dfca95a4bab067da12152a8557fa1b9937918b306358","observation_id":"64cb2192-2eff-4fd7-91db-715ac718e3c8","resolution":{"observed_at":"2026-08-08T14:03:49.290973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.278783Z","title":"hard prompt","venue":null,"work_id":"cd075dc8-d98e-4537-b849-a5df8651a602","year":2002},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.891027Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:bcded22d2dba2e60fbe6c47a3f9f39a3b5cfafd18667a30bcb5b815ce3b0baab","observation_id":"b6fee4ce-012f-4d93-a62c-8887ecabe748","resolution":{"observed_at":"2026-08-08T14:03:49.281863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.261452Z","title":null,"venue":null,"work_id":"d57f1afe-40ac-4e56-8dda-2a92b207202b","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.896855Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:b55662ecbfe127d7812f9acd5e70e8f8b0fe4fb25e892e5b713863101bd7e4cd","observation_id":"ee8168ba-786b-4cfd-9ef0-e7a2113c30b7","resolution":{"observed_at":"2026-08-08T14:03:49.264340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.251950Z","title":"per-task grid","venue":null,"work_id":"5fe88394-636e-49b0-b32c-8fa1b4947981","year":2022},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.899547Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:b4a90a1a968c64b0bd44f00e87647abf79978420bff26ec5224131a6d2ffed00","observation_id":"46fa6309-44f8-469f-b353-462e7e67888a","resolution":{"observed_at":"2026-08-08T14:03:49.255245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.241116Z","title":"The HSV color histogram and Gabor texture priors give extra cues that the random-prompt baseline cannot recover","venue":null,"work_id":"9ecdf807-f10b-4238-8442-2d8cc493e1ec","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.902204Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:bd6cedc62604364dd898e62d3b8c79ee8018eaa0caab7ad4ec214ad61b0cde02","observation_id":"674cab15-a029-47d1-9f36-7a2be730eb38","resolution":{"observed_at":"2026-08-08T14:03:49.244811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.230890Z","title":"Extra Params","venue":null,"work_id":"f2e6a94a-327e-4952-aebd-7c8e14bef7ca","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.905238Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:4edcfa8b68b9a6e05e2b4a31c9f1c240517f07fb2d0b80a504565dc2fcb051a1","observation_id":"b3f34a86-1fd5-4a69-8db2-82c76b09ad80","resolution":{"observed_at":"2026-08-08T14:03:49.234229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.221134Z","title":null,"venue":null,"work_id":"da27f55e-76b0-4003-9f9c-4d5c36bbf9fa","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.908010Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:f585b227f00db6758f3b191b500fe1cd67068f1ea1c723a536b5130f41d8c6ac","observation_id":"fa21ca36-84d3-4523-b1a4-c5b275fabd29","resolution":{"observed_at":"2026-08-08T14:03:49.224314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.210945Z","title":null,"venue":null,"work_id":"161aebc4-0936-4dce-96f2-f92e8b0052d9","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.910691Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:3bc0343f3215a90d6df497acf82e37a716f634424198295b4daee34bedbdca16","observation_id":"ca7f5b6d-27f3-4298-810f-ff45e08f9d3c","resolution":{"observed_at":"2026-08-08T14:03:49.214612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.200865Z","title":"Spending it on re-learning a Sobel filter is wasteful when the fixed Sobel filter already does the job at zero parameter cost","venue":null,"work_id":"8c7b5404-da4f-42f6-85bb-ce2d5103afe9","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.913339Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:36f502f2e05e803069ca4bf3d7d68250143a40e0992fd773d7de55b11e7a707b","observation_id":"7b2f8bff-73a5-4b5e-9514-1b3bcb4d976d","resolution":{"observed_at":"2026-08-08T14:03:49.204511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.347976Z","title":"Indexing via color histograms","venue":null,"work_id":"e068bd47-dfa1-4e7a-b3e0-8d0feb5215f6","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.855761Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:b524cb90aa379b6cb3135e3df7daa9c7a313796721f14c727fe405b0b74b4111","observation_id":"18e1bb6d-bcc8-4740-8b0f-200e21517132","resolution":{"observed_at":"2026-08-08T14:03:49.351160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01066","last_updated":"2019-09-04T09:33:20Z","snapshot_observed_at":"2026-07-06T08:18:37.267833Z","submitted_at":"2019-09-03T11:11:08Z","title":"Language Models as Knowledge Bases?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01066","snapshot_observed_at":"2026-08-08T14:03:48.851792Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.851792Z"},"links":{"cited_paper":"/paper/1909.01066","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:829ae21912ee7c3c9dc988bdbc0be5765fb6e770b146e37323414e3e93b60993","observation_id":"da502af1-ccef-491e-8d8d-fbf5271bbdf8","resolution":{"observed_at":"2026-08-08T14:03:48.851792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-08T14:03:48.833277Z","title":"Qlora: Efficient finetuning of quantized llms.Advances in neural information processing systems, 36:10088–10115, 2023","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.833277Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:aa46b6a88a17d0913fa0b47612a0a7f2cfb1bb9e0513e18a3f9cf8ee2d11e646","observation_id":"c9f648b5-975d-4a81-94aa-f6b7cef06fc0","resolution":{"observed_at":"2026-08-08T14:03:48.833277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13770","last_updated":"2023-07-25T19:03:21Z","snapshot_observed_at":"2026-07-06T15:58:31.756298Z","submitted_at":"2023-07-25T19:03:21Z","title":"E^2VPT: An Effective and Efficient Approach for Visual Prompt Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13770","snapshot_observed_at":"2026-08-08T14:03:48.836848Z","title":"Imagenet-trained cnns are biased towards texture; increasing shape bias improves accuracy and robustness","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.836848Z"},"links":{"cited_paper":"/paper/2307.13770","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:c130d9a32f8d2f061631054bfe258160211b93646ab48fe5b4968b8297c3eb77","observation_id":"e26df252-12cd-4732-a043-8c423901b5b2","resolution":{"observed_at":"2026-08-08T14:03:48.836848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.86524","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.071097Z","title":"11 Naftali Tishby and Noga Zaslavsky","venue":null,"work_id":"dcc093ea-3fbe-438d-937a-43e4b0d939d3","year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.858764Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:fcf55dc264763059460597aea079c50e5df069034effee2d3e5d8a862de8554d","observation_id":"94e04169-a0ff-4f22-8254-4b1eb7559968","resolution":{"observed_at":"2026-08-08T14:03:49.077833Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-08T14:03:48.828977Z","title":"Improved baselines with momentum contrastive learning.arXiv preprint arXiv:2003.04297, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.828977Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:8f7b5909304a13d4084f7e8e9308d94b44cb91423e5c2cce9b8d95621def514f","observation_id":"66c9ef1f-a4e2-491c-86d4-92d7ff86c8c6","resolution":{"observed_at":"2026-08-08T14:03:48.828977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.270188Z","title":"Fundamental Image Priors","venue":null,"work_id":"c419def4-6ef6-4c76-9e82-a92e269ac133","year":2022},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.893872Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:5f7cfd86f2663ca55fe4c24b99ccdff28eb0ecce973f1cf7cbf4bab6b5c2a203","observation_id":"86ae137f-1b89-41a8-b2d2-19b9b8f58b08","resolution":{"observed_at":"2026-08-08T14:03:49.273014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-07-06T10:29:18.734092Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-08T14:03:48.844354Z","title":"Prefix-tuning: Optimizing continuous prompts for generation.arXiv preprint arXiv:2101.00190, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.844354Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:09442b89583420e6e582233ca0142e29b6bfa56eb37831efc33245fb738ab21e","observation_id":"203f00fd-6a73-42d4-9e18-a91c5e555b08","resolution":{"observed_at":"2026-08-08T14:03:48.844354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T23:10:42.330386Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2608.05393."}