{"as_of":"2026-08-10T01:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1acaecc56aae079f0f46831f3c5ab4c5d56030e8cb73724024135c0da503ef9","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:12:20.961681Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:59:35.365366Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T16:53:00.079094Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03541","snapshot_observed_at":"2026-08-05T14:59:35.365366Z","title":"Foundation versus domain-specific models: Perfor- mance comparison, fusion, and explainability in face recog- nition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20626","last_updated":"2025-08-28T10:19:06Z","snapshot_observed_at":"2026-08-09T14:36:22.328177Z","submitted_at":"2025-08-28T10:19:06Z","title":"ArtFace: Towards Historical Portrait Face Identification via Model Adaptation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T14:59:35.365366Z"},"links":{"cited_paper":"/paper/2507.03541","citing_paper":"/paper/2508.20626"},"observation_digest":"sha256:4ddfcbdee0b665f0d904a5f0e5b9bf007e3e3f1c11b44c600af0a01fb3537a4d","observation_id":"4b73e817-a026-4f9c-9fca-30e2c2619c89","resolution":{"observed_at":"2026-08-05T14:59:35.365366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"cited_work":{"arxiv_id":"2507.03541","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03541","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Foundation versus domain-specific models: Perfor- mance comparison, fusion, and explainability in face recogni- tion","venue":null,"work_id":"5be37a0b-5d7b-4470-abb1-80ff9eaa1b6f","year":2025},"citing_paper":{"arxiv_id":"2604.03841","last_updated":"2026-04-04T19:45:25Z","snapshot_observed_at":"2026-07-06T22:52:57.182669Z","submitted_at":"2026-04-04T19:45:25Z","title":"Training a Student Expert via Semi-Supervised Foundation Model Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T16:50:57.376622Z"},"links":{"cited_paper":"/paper/2507.03541","citing_paper":"/paper/2604.03841"},"observation_digest":"sha256:b65aba7d482cb9fa453ed52936ad35c253dd5e44e8da4a5b9bc115c3313d6f12","observation_id":"96fa4867-9652-4c67-8075-88314dffdf4f","resolution":{"observed_at":"2026-05-13T16:53:00.080565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.03541/citation-record","integrity":"/paper/2507.03541/integrity","json":"/paper/2507.03541/citation-record.json","paper":"/paper/2507.03541"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:23.308529Z","title":"Technical report, National Institute of Standards and Technology, 2025","venue":null,"work_id":"5f2bf3f2-e706-44a7-b452-1d9290e5689b","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.706974Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:6f7e6565048826b16b07f65c6853531e5b8c7e0250bff593186eba1cd16afb25","observation_id":"d278ade9-90d6-4838-9fe2-23a5f305782c","resolution":{"observed_at":"2026-08-06T20:12:23.384428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.07315","last_updated":"2023-01-18T05:34:57Z","snapshot_observed_at":"2026-08-09T14:36:17.034398Z","submitted_at":"2023-01-18T05:34:57Z","title":"Face Recognition in the age of CLIP & Billion image datasets","version":1},"cited_work":{"arxiv_id":"2301.07315","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.07315","snapshot_observed_at":"2026-08-06T20:12:21.366022Z","title":"Face Recognition in the age of CLIP & Billion image datasets","venue":"cs.CV","work_id":"08427001-aa82-4add-b27e-3441ef9aec55","year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.712115Z"},"links":{"cited_paper":"/paper/2301.07315","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:06bf3a4b7e3c95e1742ebac9ca2c011e3ac546c83cde87ad3620e52f83aa9f5b","observation_id":"5760f778-7b26-4287-867f-165a76228b2a","resolution":{"observed_at":"2026-08-06T20:12:21.372883Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-06T20:12:20.716838Z","title":"On the Opportunities and Risks of Foundation Models.arXiv preprint arXiv:2108.07258, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.716838Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:962d49cf7d1938f442d839858bebf3d10cae49772cf8f8e7dcbe9a17f1f9da87","observation_id":"d3dd8ade-dc4c-40a0-b345-f4e2040ea647","resolution":{"observed_at":"2026-08-06T20:12:20.716838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:23.156231Z","title":"Emerg- ing Properties in Self-Supervised Vision Transformers","venue":null,"work_id":"d2517f29-ce97-4558-a160-9ae325573790","year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.721748Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:45fba792d3ab861daa134eac2d5e41a438d122028a246b96b096b1981dadffe8","observation_id":"c4fb0193-fe4e-47a0-bd42-f7500050b7eb","resolution":{"observed_at":"2026-08-06T20:12:23.259953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:23.037646Z","title":"InternVL: Scaling Up Vision Foundation Models and Aligning for Generic Visual-linguistic Tasks","venue":null,"work_id":"4d415e6c-9931-4279-8223-cb1a21edca39","year":null},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.726620Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:c5e81cbd5736767494a85c797c1efb7e16ae19599530e446f45e92d849642127","observation_id":"cf8c6623-dd7e-4222-9dc1-a3b04c3e636b","resolution":{"observed_at":"2026-08-06T20:12:23.102831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:22.905513Z","title":"Reproducible Scal- ing Laws for Contrastive Language-Image Learning","venue":null,"work_id":"d17fdeb4-cf7c-4403-8de6-0f4ba7799509","year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.731217Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:38ccf2e18832ba3fac4b6566a2535d4771e44660f42a9fcd4c6643d32b9623d4","observation_id":"b1b0a315-ba1d-41c7-ab5a-c5b62b7cac6f","resolution":{"observed_at":"2026-08-06T20:12:22.936362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:22.747354Z","title":"FRounda- tion: Are Foundation Models Ready for Face Recognition? Image and Vision Computing, 132:104815, 2025","venue":null,"work_id":"937150fb-a975-4cba-b400-ec932344bd1a","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.735885Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:8562f3c662a7e649ce3e28e1c4a3b6e9b9e263c63297a8ab1888aec04b894558","observation_id":"e6c23df1-9f4d-4375-a89a-d61568432e2e","resolution":{"observed_at":"2026-08-06T20:12:22.820602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:22.597009Z","title":"MS1MV2 Dataset","venue":null,"work_id":"e7ddb848-e817-4890-bfc6-e08b6302c4d3","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.740960Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:456983342e24ed629de065105ac7e101a480925a851b4ca1f07d3e29eb4ec152","observation_id":"926023a7-5293-4155-b271-5a76cbaf0449","resolution":{"observed_at":"2026-08-06T20:12:22.689937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-06T20:12:20.745760Z","title":"DeepSeekMoE: Towards Ultimate Ex- pert Specialization in Mixture-of-Experts Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.745760Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:19309f24f6a5b611a6cf081b1c205fd7ded1dcb47959fc19582c4145ccb3f900","observation_id":"90a828be-1838-4ecf-bd0c-46ade9e6ba13","resolution":{"observed_at":"2026-08-06T20:12:20.745760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:22.405773Z","title":"How Good is ChatGPT at Face Biomet- rics? A First Look Into Recognition, Soft Biometrics, and Explainability","venue":null,"work_id":"2fe9b1b4-2820-4214-8a2e-3b4e3788dc1b","year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.750800Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:690392f01bc35f624ccce0e424bba4996f62589d32b0858d85bab766f75d52c0","observation_id":"a4f95dd0-7af5-4c92-8836-ac2eecc21573","resolution":{"observed_at":"2026-08-06T20:12:22.520637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:22.263395Z","title":"ArcFace: Additive Angular Margin Loss for Deep Face Recognition","venue":null,"work_id":"da200906-3b3f-463e-9bd4-4b5c797b5b21","year":2019},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.755193Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:18b2633a1a6daccf0f55ae9231dd33e518d306aea928f3d32659060aaa47e506","observation_id":"a778d4c4-4827-4939-88b3-23ef853aabdd","resolution":{"observed_at":"2026-08-06T20:12:22.344780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:22.175323Z","title":"Lightweight Face Recognition Chal- lenge","venue":null,"work_id":"c9c2b9c3-46c3-450a-9668-33a42c518b76","year":null},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.759737Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:63370cc2c2979f58a31bb6630a2637565cb42dbf38eacd8d712dae2ef27aee5b","observation_id":"f8b66350-a64f-4c1e-9432-fcebb8fc4bd9","resolution":{"observed_at":"2026-08-06T20:12:22.207497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:22.039853Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":null,"work_id":"8726db7b-9996-48db-9136-ed27383fce47","year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.764589Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:0e2e0cbd886b5ef1640e701949ad1d5075956483e716f12ad8855984e3c3e5c7","observation_id":"b46c54f8-fbdc-478c-b71c-3cb23a1a321c","resolution":{"observed_at":"2026-08-06T20:12:22.093098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.947841Z","title":"ChatGPT Meets Iris Bio- metrics","venue":null,"work_id":"a5098ca8-663a-401d-992e-732a8c1bfff9","year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.769242Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:1693f9a7dc8dc75ab423d739ad5f8ae87dff891496bad621fb8bf7c171ff3ded","observation_id":"f2381a6e-d629-49d7-90c9-1077f30fdd47","resolution":{"observed_at":"2026-08-06T20:12:22.010966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.885844Z","title":"Iris-SAM: Iris Segmenta- tion Using a Foundation Model","venue":null,"work_id":"b4655264-a19e-43f4-afe3-1af708ae093c","year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.773791Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:f4a5e8c1f64ecb33412e3f0e6197cc8f9a20fc720daf0e45acf9a81673c135f2","observation_id":"fb33ebe4-88a5-4e29-ba10-75389577abf7","resolution":{"observed_at":"2026-08-06T20:12:21.898415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.843879Z","title":"ChatGPT and Biometrics: An Assessment of Face Recognition, Gender Detection, and Age Estimation Capabilities","venue":null,"work_id":"eab1c241-d02a-48ca-ba57-552797727709","year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.778431Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:7b67662fa87ea51abcd6fdc2c8687497adb5be069210184104cf6dabf0a0ec10","observation_id":"dc67984c-68dd-45d1-abaf-ae52f0264934","resolution":{"observed_at":"2026-08-06T20:12:21.861773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.822553Z","title":"Huang, Marwan Mattar, Tamara Berg, and Eric Learned-Miller","venue":null,"work_id":"7f313591-0e93-4efe-86c3-c446b4c3cf6c","year":2008},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.782710Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:306a9443115ddc606ccaefd94de28f90b379759676f0fd41772ce2b68d1e1df5","observation_id":"37aa7aea-1dfa-4560-9a52-d23da8998c81","resolution":{"observed_at":"2026-08-06T20:12:21.828994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.794400Z","title":"OpenCLIP: Open-Source CLIP Reproduction","venue":null,"work_id":"19dfe025-259d-4e01-9375-e6cee275007c","year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.787462Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:957da4f30fbebe9f85440d41890faf6c411c1a45d3d6e4cfe9d3bd96bdecb28c","observation_id":"b03541c1-a26f-4838-9544-b588d48be7ee","resolution":{"observed_at":"2026-08-06T20:12:21.806197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.770139Z","title":"Jain, Arun A","venue":null,"work_id":"2a05e67f-d9bf-429c-b699-e8a30353abd5","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.791780Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:520d5b110f82593e9062e99f295906f7be2f86db370cba85d360b316d9816949","observation_id":"d0ca887e-159f-4cf3-9a6a-ddce5a038041","resolution":{"observed_at":"2026-08-06T20:12:21.777733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.746913Z","title":"Scaling Up Visual and Vision-language Represen- tation Learning With Noisy Text Supervision","venue":null,"work_id":"4806b43b-9ff0-41c7-bc77-0580d1754b01","year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.796152Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:e03987db94b5943edfd797343ade17f4c4ce6e687c8d50f23b18ef939f6717cf","observation_id":"8f8fa273-5e88-48a3-a7fd-9eec2f67c68c","resolution":{"observed_at":"2026-08-06T20:12:21.754841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.726887Z","title":"Kalka, Brianna Maze, James A","venue":null,"work_id":"290bd9d2-1bc7-4228-9494-4827537189ec","year":2018},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.800817Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:2cbc7daa8868e895c360b225e9053124eca2d7d62d63ca99843b7dbc7a6f9396","observation_id":"52ead8fd-36ce-4eb2-990e-d14a4e7a3e3d","resolution":{"observed_at":"2026-08-06T20:12:21.735073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.708508Z","title":"Jain, and Xiaoming Liu","venue":null,"work_id":"f672e7fd-c7b0-4d34-bce6-849676fe34ab","year":2022},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.805293Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:187391cbcd60de5e3abec2ab5bf90b1872c8107a7d76cc4ebc2ce1f6ec9d21b3","observation_id":"1d035294-0c5b-4b03-8972-be27ef710072","resolution":{"observed_at":"2026-08-06T20:12:21.716412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:20.809927Z","title":"Jain, and Xiaoming Liu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.809927Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:51aa70bc07531e26a61ac6e3068956be037a9f7199235b4254c23acda528e65c","observation_id":"9c6a8ae8-1f22-46e5-a09e-07f6093319b6","resolution":{"observed_at":"2026-08-06T20:12:20.809927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.689463Z","title":"Berg, Wan-Yen Lo, Piotr Dollar, and Ross Girshick","venue":null,"work_id":"49e4d7ff-bafc-4545-9b29-56210ee0f38b","year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.814213Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:9f5b71eb41fee6a909897f84968379f572066bc6b9aa9871dce7da01ec599a9e","observation_id":"a77a017c-a0b0-45e1-bc66-d0f0ea7c9da7","resolution":{"observed_at":"2026-08-06T20:12:21.696363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.675591Z","title":"Exploring ChatGPT for Face Presentation Attack Detection in Zero and Few-Shot in-Context Learning","venue":null,"work_id":"247fa7e4-9e2d-4104-84e6-bde7908ae917","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.819054Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:9741e59e005e523dd85b4255377c8193ab7113011256e90491095603084aa42e","observation_id":"ba366a29-feef-45ca-a837-b244f9cc0d7f","resolution":{"observed_at":"2026-08-06T20:12:21.680074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.661367Z","title":"BLIP: Bootstrapping Language-image Pre-training for Uni- fied Vision-language Understanding and Generation","venue":null,"work_id":"b148e815-7640-4b91-b23e-b3737c5fc723","year":2022},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.823823Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:f863b2cbe8a6ea400f66987d0f2a376d4dbeb501fae7e98b7ceea7e02d4e3985","observation_id":"37936dc0-fe14-4191-b2c3-a0f4ebf3d492","resolution":{"observed_at":"2026-08-06T20:12:21.666123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.646814Z","title":"BLIP-2: Bootstrapping Language-image Pre-training With Frozen Image Encoders and Large Language Models","venue":null,"work_id":"d1a9c137-7977-411c-ab0a-173d5296cebb","year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.828240Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:bcd2818b0a6f0e5f101a0c8a5ba6eb1be13036363e4f42b321beef7491f8534b","observation_id":"84522745-a2c5-4658-93bd-389558d22b6b","resolution":{"observed_at":"2026-08-06T20:12:21.651555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.632900Z","title":"Improved Baselines With Visual Instruction Tuning","venue":null,"work_id":"6feef9e9-1dda-4d4e-b56b-b525ad17a8f1","year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.832542Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:8bf54338915c6d5c5a79523cef124d46709d341f9caa1e37c4255eba49375cda","observation_id":"240e5c11-1f7e-468b-8b57-2234d3591774","resolution":{"observed_at":"2026-08-06T20:12:21.637541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.618162Z","title":"LLaV A-NeXT: Im- proved Reasoning, OCR, and World Knowledge, 2024","venue":null,"work_id":"3d0705f0-1015-4c05-b4ea-bcc553c63127","year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.837112Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:3a51b0f47156476103fcbd6d9ea27a99207b6a9904f3d3e06f1e729b44ca978e","observation_id":"7d6ecbd2-a35d-422a-9158-ae6b9be26fd6","resolution":{"observed_at":"2026-08-06T20:12:21.623151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.602438Z","title":"SphereFace: Deep Hypersphere Embed- ding for Face Recognition","venue":null,"work_id":"ec8a51bf-2476-4804-9eed-e3a28858a4f9","year":2017},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.841546Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:dd2a59fbb7b88beb348950c8a37c3aac69f91ee559ac933c5aa97bbdd53e86d3","observation_id":"b6f21ef8-d293-41e1-844f-29c9a6069727","resolution":{"observed_at":"2026-08-06T20:12:21.607624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.587759Z","title":"Duncan, Nathan Kalka, Tim Miller, Charles Otto, Anil K","venue":null,"work_id":"097b89fe-eec3-4cdd-bc2a-812df3f1720a","year":2018},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.846143Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:9fc2a0b9ab5528a5bc95e5868e290e8cfab33107745a8b9c407c6491bf856d1c","observation_id":"13caee5f-af3e-44d4-ae08-5802f785670e","resolution":{"observed_at":"2026-08-06T20:12:21.592456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.572277Z","title":"Segment Anything Model for Medical Image Analysis: An Experimental Study","venue":null,"work_id":"ffbe96f4-97c9-487e-8c20-9abbfb162781","year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.850593Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:a707f5feb5c25eadb7b2eaa48ac2b60df433cb81e21852ab9eacfff624245bfe","observation_id":"5beed6d8-1ca9-482e-aef6-4df3df06e100","resolution":{"observed_at":"2026-08-06T20:12:21.576994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.556564Z","title":"MagFace: A Universal Representation for Face Recognition and Quality Assessment","venue":null,"work_id":"6bd61afd-3b21-4091-b46c-bd125fe6d864","year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.855170Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:e25831de6cc6f4072a2ad2685ea75ebb80756596fcedbc3dba62f817603ff800","observation_id":"4ddd8112-d2fd-4019-a7d6-d64ee27c9fd1","resolution":{"observed_at":"2026-08-06T20:12:21.561876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:20.860444Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.860444Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:e3609087fcdd44172077b367409b688d6b52ddeef338612133217532b8b5e7e2","observation_id":"2c26d694-76b2-4b79-b379-b15b3bb0ca7f","resolution":{"observed_at":"2026-08-06T20:12:20.860444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T20:12:20.864973Z","title":"GPT-4 Technical Report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.864973Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:68bd619d6ee771479b90c0c078dd5a8aa9e34d01de041a0c442c8ffa9069f095","observation_id":"0f6d820f-1be1-4786-b7b0-fc98d0b61ec9","resolution":{"observed_at":"2026-08-06T20:12:20.864973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.541613Z","title":"GPT-4o System Card","venue":null,"work_id":"f2a2d5c5-3e91-4c33-adbb-37f8ea948ecc","year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.869942Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:1eec26d331df028c173e9a570d0cff99eae35e764638e57fce7e9767b2392fe3","observation_id":"fae3f88d-758e-4108-867c-0f87b7d35c0c","resolution":{"observed_at":"2026-08-06T20:12:21.546403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T20:12:20.874969Z","title":"DINOv2: Learning Robust Visual Features Without Super- vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.874969Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:2b091c2ae4669dee3a339898d0aa7b44a96a31c5b72ce81b244e4fb745daca65","observation_id":"ae3f7783-ad44-4a3a-b801-fbb70f7d49bf","resolution":{"observed_at":"2026-08-06T20:12:20.874969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.524659Z","title":"FoundPAD: Foundation Models Reloaded for Face Presen- tation Attack Detection, 2025","venue":null,"work_id":"b87fca68-3042-4bc3-9c7b-8cc656a9bacb","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.879462Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:4b94ba1e71bb0078ebaf8ea3dbc920c5a43fb823c1b385af9db97e8d9e588f10","observation_id":"6bd892dc-8115-4e42-ab56-54ae2b736ac9","resolution":{"observed_at":"2026-08-06T20:12:21.530717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-06T20:12:20.884123Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.884123Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:266fd75d129d594503748b7da2ebaf2d30a06fe6b5a18f815c1e648667d1e551","observation_id":"73a3e708-d4c0-45dc-8c2e-59b9ea87119c","resolution":{"observed_at":"2026-08-06T20:12:20.884123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.509043Z","title":"Learning Transferable Visual Models from Natural Language Super- vision","venue":null,"work_id":"5662f749-d5c7-45bf-9486-51cdcaad4bc5","year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.889184Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:cfe54337c4cacc14512780530597f41018470821d9ffad3f706521fead48725a","observation_id":"4d3105e1-c27d-4770-8bad-26bdb112d34e","resolution":{"observed_at":"2026-08-06T20:12:21.514251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.494249Z","title":"SAM 2: Segment Anything in Images and Videos","venue":null,"work_id":"d9265c81-6da0-453a-adb4-ed81096d8fd1","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.893963Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:6760822e49a477f7b4c451e40a7a37bdd7f97ce764d0490b4e25dda0b820c98c","observation_id":"26102f57-b261-4bfe-a289-9120b0820ce7","resolution":{"observed_at":"2026-08-06T20:12:21.499356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07927","last_updated":"2025-03-16T06:23:34Z","snapshot_observed_at":"2026-08-05T17:55:26.008016Z","submitted_at":"2024-02-05T19:49:13Z","title":"A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07927","snapshot_observed_at":"2026-08-06T20:12:20.898505Z","title":"A System- atic Survey of Prompt Engineering in Large Language Models: Techniques and Applications","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.898505Z"},"links":{"cited_paper":"/paper/2402.07927","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:e0041ef12453bebabb2118547f04d57bf9587602de007a8519e24b30513978d1","observation_id":"85e581fc-6061-4700-aa51-157301ef4674","resolution":{"observed_at":"2026-08-06T20:12:20.898505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.478844Z","title":"FaceNet: A Unified Embedding for Face Recognition and Clustering","venue":null,"work_id":"e3de51f5-ee6e-48ed-b134-80ea0a26d6f6","year":2015},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.903603Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:0b55b9fadb2e5cd6018720142a5252b5df5034781807c5943d5b6e9087c44935","observation_id":"31247505-d03d-4bc8-bb38-2d7e1d6b4d6f","resolution":{"observed_at":"2026-08-06T20:12:21.484222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.463901Z","title":"Foundation Models and Biometrics: A Survey and Outlook","venue":null,"work_id":"ad8cd695-3491-4157-a6fd-06eecbf571af","year":null},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.908122Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:8f5568ba23758a0c2f8d2e761f8923c46fe9e47b8c4b51b4f89caf0d986284b7","observation_id":"bdc7a615-85fb-49c8-bf27-bb80074646f1","resolution":{"observed_at":"2026-08-06T20:12:21.468885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24214","last_updated":"2025-05-30T04:53:55Z","snapshot_observed_at":"2026-08-07T12:27:14.242511Z","submitted_at":"2025-05-30T04:53:55Z","title":"Benchmarking Foundation Models for Zero-Shot Biometric Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24214","snapshot_observed_at":"2026-08-06T20:12:20.913011Z","title":"Benchmarking Foundation Models for Zero-Shot Biometric Tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.913011Z"},"links":{"cited_paper":"/paper/2505.24214","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:9167124f7ba234ab49fff62e1b9792b305348a9cef4e3fb3ecc49c4051b2f32d","observation_id":"cae588d5-5aaf-4fe7-ba9b-8cc8d7570f64","resolution":{"observed_at":"2026-08-06T20:12:20.913011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06312","last_updated":"2025-01-10T19:26:28Z","snapshot_observed_at":"2026-07-06T20:19:30.457335Z","submitted_at":"2025-01-10T19:26:28Z","title":"Towards Iris Presentation Attack Detection with Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06312","snapshot_observed_at":"2026-08-06T20:12:20.917817Z","title":"Towards Iris Presentation Attack Detection with Foundation Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.917817Z"},"links":{"cited_paper":"/paper/2501.06312","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:1a8dd718100f43f5c813f05f43c9ccc01f2ef5c9fa6113711dbdf2941992b6f7","observation_id":"280eeabb-2abe-46e0-a6aa-3bcdba9989b9","resolution":{"observed_at":"2026-08-06T20:12:20.917817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T20:12:20.922509Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.922509Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:01b5c96b61a2805e89c4f151d7307889883cd83445561da0df96554036345055","observation_id":"3af81ce6-7f94-4950-8544-bb03bdf32153","resolution":{"observed_at":"2026-08-06T20:12:20.922509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.447200Z","title":"CosFace: Large Margin Cosine Loss for Deep Face Recognition","venue":null,"work_id":"0f28db7c-db20-4d45-940a-5c1fc6527404","year":null},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.927284Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:e97fa44ad1fb8f90c2777f818672b999e53232d8c6231217e071cc23cb7d555a","observation_id":"dd19fb99-5ed4-49f2-b54b-d7514fc65463","resolution":{"observed_at":"2026-08-06T20:12:21.452230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00001","last_updated":"2023-11-18T05:01:37Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-11-18T05:01:37Z","title":"Sector Rotation by Factor Model and Fundamental Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00001","snapshot_observed_at":"2026-08-06T20:12:20.932560Z","title":"DeepSeek-VL: Towards Scaling Up Vision-Language Mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.932560Z"},"links":{"cited_paper":"/paper/2401.00001","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:7100534c2a97d00e1c0cd05a9e994daae928d9b77191fe928d4f9ba500cb4b3b","observation_id":"a63b74e1-62ca-46bc-8057-33b8893f8287","resolution":{"observed_at":"2026-08-06T20:12:20.932560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.431840Z","title":"Jain, James A","venue":null,"work_id":"d0a0c279-5d5f-4702-89ce-029686d4ba8b","year":2017},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.937182Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:b269afbe2da28b1348fe53384d7ece065554a75c3e0bcbc01aa59ad3b86d98b8","observation_id":"d7fb838b-7e24-4114-a2b6-7cb543f9db81","resolution":{"observed_at":"2026-08-06T20:12:21.436387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T20:12:20.942000Z","title":"DeepSeek-VL2: Mixture-of- Experts Vision-Language Models for Advanced Multimodal Understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.942000Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:5a1c17a8c4b0230920320bf269627a0fedcd529c1e0d4417154e93a7ccbd9cc4","observation_id":"604c3992-4a15-460e-b7d0-44eeda4e2d4e","resolution":{"observed_at":"2026-08-06T20:12:20.942000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.416539Z","title":"Grok-4 Language Model","venue":null,"work_id":"d31e1e9b-3f7a-4d6f-a730-4f2344030025","year":2025},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.946729Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:c0d428bd73c6553364ca593e0ee8e5ff96d44e4d8f06cb27bcb106965bc22dd7","observation_id":"1b5cd669-612c-4a32-a0cd-96d3b868be88","resolution":{"observed_at":"2026-08-06T20:12:21.421554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.399845Z","title":"Cross-Pose LFW: A Database for Studying Cross-Pose Face Recognition in Un- constrained Environments","venue":null,"work_id":"de244574-374d-4c0f-af00-0b54dc2e2c47","year":2018},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.951922Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:c8edd523abd050f7e390dd6133b9292d1fae5e5b94751c330c91ff8a6fd36217","observation_id":"66ff6195-79cc-44be-93a9-7bb79815baab","resolution":{"observed_at":"2026-08-06T20:12:21.404719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T20:12:20.956555Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Mod- els, (Technical Report)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.956555Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:6f0b895d8fe96d279c187d172d4eed0500fee574fccc7d8132fc7c1e794daec7","observation_id":"fd02ebad-55c7-4314-b2ce-37e4ab195079","resolution":{"observed_at":"2026-08-06T20:12:20.956555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:21.383964Z","title":"WebFace260M: A Benchmark Unveiling the Power of Million-Scale Deep Face Recognition","venue":null,"work_id":"88d754b0-166f-45a0-af92-afcf46b6cc31","year":2021},"citing_paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:12:20.961681Z"},"links":{"citing_paper":"/paper/2507.03541"},"observation_digest":"sha256:b4c232d84d9911b760bafe6051ce15a4b249c965bd1f7cb7f11d03a3a900845b","observation_id":"e077d27c-c7b1-436d-b0bc-0b2e13efb8e1","resolution":{"observed_at":"2026-08-06T20:12:21.389372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.03541","last_updated":"2025-08-08T21:43:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T14:36:14.413699Z","submitted_at":"2025-07-04T12:46:45Z","title":"Foundation versus Domain-specific Models: Performance Comparison, Fusion, and Explainability in Face Recognition"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 2 inbound Pith citation observations for arXiv:2507.03541."}