{"as_of":"2026-08-09T07:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:00407a92b4a65411c554035517d99178052d655450b1e209ddae343c2093d290","coverage":[{"denominator":105,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T20:14:03.709995Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:48:37.280104Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:48:42.262210Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"cited_work":{"arxiv_id":"2502.09906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.09906","snapshot_observed_at":"2026-08-07T00:48:42.262210Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","venue":"cs.CV","work_id":"5f9a397e-32ee-47b6-8183-5f10393549f8","year":2025},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-07T11:53:13.790399Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":278,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:37.280104Z"},"links":{"cited_paper":"/paper/2502.09906","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:cb1256a348dc082b428c82fe03a377a62bcdc10d79ab5e1d00ce982b0cbba393","observation_id":"0aff1f99-02cd-41e2-82a9-71217b9903af","resolution":{"observed_at":"2026-08-07T00:48:42.344777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09906/citation-record","integrity":"/paper/2502.09906/integrity","json":"/paper/2502.09906/citation-record.json","paper":"/paper/2502.09906"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.304844Z","title":"Advances in neural information processing systems 35, 23716–23736 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.304844Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1d6a0029fdf6e92ba42d93e16827bacab020f5ffc1a7c1e345d85e960e258964","observation_id":"37404bae-606d-4b30-943a-bd9002d3a324","resolution":{"observed_at":"2026-08-07T20:14:03.304844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-07T20:14:03.310025Z","title":"arXiv preprint arXiv:2309.17421 9(1), 1 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.310025Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:402b105584c11edfd0537d17cc412b658898d25e9c184391a30722cf330d0f4a","observation_id":"76ed1aca-c06b-47ab-8f55-c1af14a98704","resolution":{"observed_at":"2026-08-07T20:14:03.310025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.314595Z","title":"Foundations and Trends® in Computer Graphics and Vision 16(1-2), 1–214 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.314595Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0bee40967958ef9dcf4c0fad2692db8bfaaf235258b671e9f1ac844bb8946ebb","observation_id":"54b661c5-8c48-420a-9489-cdcd81dfae23","resolution":{"observed_at":"2026-08-07T20:14:03.314595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.318622Z","title":"Advances in neural information processing systems 36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.318622Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7e05bd54f50fcf6c8bc2be47c9b237503f2e56ebde2df77bfee764022288f7ff","observation_id":"60b2b848-b6e6-45ac-bfc0-f70e05268ca1","resolution":{"observed_at":"2026-08-07T20:14:03.318622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.323591Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.323591Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:eb72d8274d9a55cf7cf5d482642c5263d2d146e070854e8900c7d71e78ea637e","observation_id":"fd3671b6-b7d2-41e4-94d7-e9ce17156e61","resolution":{"observed_at":"2026-08-07T20:14:03.323591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.327648Z","title":"Advances in Neural Information Processing Systems 36 (2024) 30","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.327648Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:4ed7cf08a443e5408bcb8b2756bae962e76c8b1f63102a81a3eecca8ac4e0558","observation_id":"5a79ad11-faa6-4968-9ca4-6e58fac87849","resolution":{"observed_at":"2026-08-07T20:14:03.327648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.332170Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.332170Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1a2de07e9052ed7a69640a1fb9cab5d5fe24162b2fb742170749297e9033f21c","observation_id":"f3fe8569-d0da-4183-a646-e2e3e336e931","resolution":{"observed_at":"2026-08-07T20:14:03.332170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.336076Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.336076Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bbe58d65cd1bd54e189c9febb7513b43a36885f9a4ab3c5aaba01adbb3dd423e","observation_id":"457331e6-9659-412f-a7be-dded7d066283","resolution":{"observed_at":"2026-08-07T20:14:03.336076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13022","last_updated":"2024-02-20T14:02:45Z","snapshot_observed_at":"2026-08-09T06:20:06.188779Z","submitted_at":"2024-02-20T14:02:45Z","title":"SoMeLVLM: A Large Vision Language Model for Social Media Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13022","snapshot_observed_at":"2026-08-07T20:14:03.339805Z","title":"arXiv preprint arXiv:2402.13022 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.339805Z"},"links":{"cited_paper":"/paper/2402.13022","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:749518dc2c029066a26a12dfd5ec470b716ff88881c2f8a80740b97a808af097","observation_id":"2d2acd22-7c27-4677-9200-e08af22d92b7","resolution":{"observed_at":"2026-08-07T20:14:03.339805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.344094Z","title":"In: Oh, A., Neumann, T., Globerson, A., Saenko, K., Hardt, M., Levine, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.344094Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:97c5d16f6d58282108d337a3dce5f4aca304b0d85d811c743fb0b9c7a7124a8f","observation_id":"a4e73dad-df90-45ef-81fe-1cd2d1b1df4b","resolution":{"observed_at":"2026-08-07T20:14:03.344094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T20:14:03.348114Z","title":"arXiv preprint arXiv:2112.00861 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.348114Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:799800e63bc400a6aec17ff4d188593d7a935063b9feb942bafb62ef5c1dc4c9","observation_id":"87ea1479-272c-4ce7-b73f-ce790a569541","resolution":{"observed_at":"2026-08-07T20:14:03.348114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.352239Z","title":"Foundations and Trends ® in Computer Graphics and Vision 14(3–4), 163–352 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.352239Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:21140e0a881395192a449f2869de8afbc6aec7c74ace6aa96580f29052de3554","observation_id":"a71cf9ed-31e4-4bfa-9bcc-64370557751f","resolution":{"observed_at":"2026-08-07T20:14:03.352239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.355930Z","title":"Advances in Neural Information Processing Systems 35, 9287–9301 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.355930Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:cc8e61e65f9869bfc001e46cc24b627ebcbdceeafc6374b15d8ca98f0be1a7a4","observation_id":"6385276a-f0a2-4db6-986a-66da21d14dd4","resolution":{"observed_at":"2026-08-07T20:14:03.355930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.359442Z","title":"International Journal of Computer Engineering Science (IJCES) 2(6), 1–13 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.359442Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:2b3c6c192182981523fd983c6489a2079dc358f8b5b7dba9cf89437ed0bdf796","observation_id":"440923f7-87af-4dff-a0b5-6295d13d4f53","resolution":{"observed_at":"2026-08-07T20:14:03.359442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.363361Z","title":"Knowledge-Based Systems 33, 102–110 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.363361Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:3d79124c237d3cf3f8aeb88c5d83a5549d8c0efdf9d36a901b73a9360702dcaa","observation_id":"03eaa6c5-5cad-4bee-97de-ee9b32f4af35","resolution":{"observed_at":"2026-08-07T20:14:03.363361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.367415Z","title":"International Journal of Machine Learning and Computing 4(1), 1 (2014) 31","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.367415Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a09634931af895890a9cb33e0a57444ae11e4843882e2504a0ab5d22967849fe","observation_id":"1c515d7c-8c9a-4ca0-8d66-ff9387ee5037","resolution":{"observed_at":"2026-08-07T20:14:03.367415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.371458Z","title":"Computers and Electronics in Agriculture119, 123–132 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.371458Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:010fcfa75409b993d1b2a7ceefd4ff4dcb4aff57027c40b6b5065ddcaa841560","observation_id":"31696014-b7ad-41e0-a959-774d69e27948","resolution":{"observed_at":"2026-08-07T20:14:03.371458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.375318Z","title":"Scientific reports 6(1), 20410 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.375318Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6e308c0e2cc62e2ed6238f44a6f7bd4752a4886cdf13e88d0785f705f23476c0","observation_id":"fcd57f5a-95f7-477f-81d6-13f7490d8f25","resolution":{"observed_at":"2026-08-07T20:14:03.375318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.378943Z","title":"Computers and Electronics in Agriculture 152, 233–241 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.378943Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6b919bdd54000d7d78d36b971082a5e6ca96cb7e9fe670adafdcfa76a6a08cf3","observation_id":"5cf598d2-bbcd-4870-beab-82f20dfc8a5c","resolution":{"observed_at":"2026-08-07T20:14:03.378943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.382898Z","title":"Biosystems Engineering 169, 139–148 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.382898Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:3844ba5d3055a1441d3089cd1f5437ec06cddea0e8cc903821bdf9263ba180ea","observation_id":"b1ca30ab-8bf5-4e49-822d-9bd71b274534","resolution":{"observed_at":"2026-08-07T20:14:03.382898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.386714Z","title":"In: Proceedings of 2018 International Conference on Mathematics and Artificial Intelligence, pp","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.386714Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d8649e5357ff0f95615196eb06a5822f2df110702b900cab87f4aa87b79e1284","observation_id":"7b4333f7-ece9-452b-b061-7744bf7a621f","resolution":{"observed_at":"2026-08-07T20:14:03.386714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.390455Z","title":"Ieee Access 7, 45301–45312 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.390455Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:e3e94a9b1c337396725f675bdc64f7ebcd7e652ce2eaec35a4304ac9cd07ca6f","observation_id":"c874fe8e-9c5a-4e1d-bd4e-85daca32c2fd","resolution":{"observed_at":"2026-08-07T20:14:03.390455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.394045Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.394045Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:20eade6e9b3af18b1f39ee2694c97819bb1caa8e6df4848304e47abc3f24da4b","observation_id":"e39be50a-7d9e-4ac4-b98e-1530d7adeb35","resolution":{"observed_at":"2026-08-07T20:14:03.394045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.398361Z","title":"Sensors 21(5), 1601 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.398361Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:92a397801d17065ac4983c5ba33e9cbe01c719b60353865ebd183cb3c9edb03f","observation_id":"8314e02e-7e28-499d-b43f-47e9e019031f","resolution":{"observed_at":"2026-08-07T20:14:03.398361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.402494Z","title":"Advances in Neural Information Processing Systems 34, 19352–19362 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.402494Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6f863e3d94cae37686074d964fde2f72578a887bcd5c44f627747e27e046debe","observation_id":"3f19b5f1-f6bd-4dd1-acfc-163f4db52ad6","resolution":{"observed_at":"2026-08-07T20:14:03.402494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.406708Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.406708Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:318f4e04594795dfd75a0d5a916f526850a4de7dd890b3f876a11a5bcc9e62c2","observation_id":"6a3f8765-9406-4c21-8fa7-313d3657095f","resolution":{"observed_at":"2026-08-07T20:14:03.406708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.410874Z","title":"In: Proceedings of the IEEE/CVF Conference on Com- puter Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.410874Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:4027ddd3293dd949f57388f5fe6188682a0bf0501042e3a7035a8781e0f95279","observation_id":"f5ebeb90-c133-4b17-9240-3432b0201c98","resolution":{"observed_at":"2026-08-07T20:14:03.410874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.414841Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.414841Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:e9d2d39c01289111430f65b8964bedd7ca286a2ab7b2b8283bdbd97f69cdf131","observation_id":"1d6dec26-c7d9-456b-87a2-b25259ac868f","resolution":{"observed_at":"2026-08-07T20:14:03.414841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-07T20:14:03.418739Z","title":"arXiv preprint arXiv:2003.04297 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.418739Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0cc7344d19ca1e360d328ae6648ec78fc357843590ee8a932963dbb9b0d14a88","observation_id":"6afe6eff-3ddb-4efa-a0f5-41271803313b","resolution":{"observed_at":"2026-08-07T20:14:03.418739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.423671Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.423671Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:59875d05d2f80de8df09fe0f7df51c23713954fa2cba55edeac36d93e4c5c0fe","observation_id":"77c42442-f315-44b9-abc4-8ce86291c80c","resolution":{"observed_at":"2026-08-07T20:14:03.423671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.819236Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"afdb6f6c-f256-4bed-b357-6756417519e8","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.427630Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:9b10bdad6259ed41ef921d5aa7ac665c5d45d66534a80e7efb0425e7d65bb483","observation_id":"0f05c0c2-5747-4b1a-97ed-ed263aefdd19","resolution":{"observed_at":"2026-08-07T20:14:04.823268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.431647Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.431647Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d430165edcc1e3b04cbcd736f4764ef621dfac445ea39fe6406d222445062602","observation_id":"cc50681f-8de4-4a93-af89-c876f964ee10","resolution":{"observed_at":"2026-08-07T20:14:03.431647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.435589Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.435589Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:af9e802f1062646eed1978b96edaf9edc72699c90989644dbd6e4422f054ae6b","observation_id":"f21b0a71-63f9-47f4-a0ce-5bf923a96c1e","resolution":{"observed_at":"2026-08-07T20:14:03.435589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T20:14:03.439692Z","title":"arXiv preprint arXiv:2304.07193 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.439692Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bffda94d9599b9297a49242bece9560cffbf1425d20ab9ae5d2f2feff3afc7bd","observation_id":"ed707109-b829-4364-97b2-4ca2c0aa55c1","resolution":{"observed_at":"2026-08-07T20:14:03.439692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.443937Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.443937Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b1d3e71da625c02144b181adb2dd8324d241baa9e15639811239aa4628784c6a","observation_id":"b6bc50e2-8fa1-4e14-8c4f-7026cda6e07b","resolution":{"observed_at":"2026-08-07T20:14:03.443937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-07-06T13:06:27.153765Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-07T20:14:03.447952Z","title":"arXiv preprint arXiv:2205.01917 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.447952Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:4015a374201c1fa840a21f09a9834658851c789b90b166d7e3aadfa1a539c219","observation_id":"965023a3-95d7-498e-9c91-b8a7240ffe7d","resolution":{"observed_at":"2026-08-07T20:14:03.447952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.452103Z","title":"In: 2009 IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.452103Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:48ace42f663dd6536039ae4efbfc331c4b6c7ac64416589ca1c7a20a69e8ba74","observation_id":"48568a13-0e90-43db-8f5c-3f0c09fbc550","resolution":{"observed_at":"2026-08-07T20:14:03.452103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.456039Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.456039Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b81aec0daef62343f2d3bb58d992ad3a3253ef60748d4609ae190bac55f4da82","observation_id":"e56bb9d5-bec8-4907-93f2-55451d98abe2","resolution":{"observed_at":"2026-08-07T20:14:03.456039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.768212Z","title":"Advances in Neural Information Processing Systems 35, 25278–25294 (2022)","venue":null,"work_id":"51a8d8b2-6448-4645-a7f4-2d9a457487ea","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.459913Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1518fccba7965ec3141ba969e5044e8a5f376d08cfca307b1da0b13aa3a40eeb","observation_id":"adf7200f-80c0-4fbb-9b35-9e18983c814c","resolution":{"observed_at":"2026-08-07T20:14:04.772142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.755781Z","title":"Computers and Electronics in Agriculture 174, 105488 (2020)","venue":null,"work_id":"92c56738-302f-4e8a-b3fb-ac84bfcc688e","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.464155Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1b0d83723186f806497fa0f78700597ee021d5724210ef51f322be262341f841","observation_id":"23660d3e-e2f0-4323-9ac3-1fa9cf8a3fa1","resolution":{"observed_at":"2026-08-07T20:14:04.759733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.744515Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops, pp","venue":null,"work_id":"680ab013-2284-4b7f-99fa-90b99b0d858f","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.468216Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a508475ea40989ecfed7f376323c0b2cc6bcc7ec4f16dab6b1012761c571b1fb","observation_id":"24ae42b4-7369-4612-90f3-e34b3387b7a1","resolution":{"observed_at":"2026-08-07T20:14:04.748477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.732166Z","title":null,"venue":null,"work_id":"3ee30160-8f92-443b-88a9-1202d3c04ed5","year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.473390Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:c0441a67b714465fad384f47f323c18e3614d1ff7367be14989a5125a332073c","observation_id":"2a48fc60-2536-4517-8eb3-74cac0c37bc1","resolution":{"observed_at":"2026-08-07T20:14:04.736799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.719916Z","title":"barcodinglife","venue":null,"work_id":"57a491c1-f017-46ac-a4a7-0e992d2a2276","year":2007},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.477561Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d9f2b5bca33f4922076e78c55e83b6cd6d7f6c8b9edc978f69b063a216c4436a","observation_id":"2708bd16-6429-46a7-9c3e-ec94bcc85cd2","resolution":{"observed_at":"2026-08-07T20:14:04.724062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.707906Z","title":"in 2021 ieee","venue":null,"work_id":"cc8dfa02-c4ed-4da9-9259-64b3661bd4f9","year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.481706Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0b43d8387f723e88c80f7df2898ffc863e5b7b8f9024e95a9fce08993a02e440","observation_id":"323ed7b2-dd32-4717-84ac-07730d5905fc","resolution":{"observed_at":"2026-08-07T20:14:04.711927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.695455Z","title":"Pattern Recognition Letters 166, 53–60 (2023)","venue":null,"work_id":"724a721d-b9ea-4c5f-a816-0213613d3e01","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.486020Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7ace6ff1a5f066257ef91a005a10bdcfe1a7732a51489faff7199127d36d2f0a","observation_id":"3bd94d62-ac21-424d-bc64-aa6635bfb926","resolution":{"observed_at":"2026-08-07T20:14:04.699632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.682620Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"3696f90e-33b1-4c5c-ba1d-bc13fb33f071","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.489916Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:aee1743e4a3cdf200a7b7226c4cb8a845848169be1de339b6f368e417bc00988","observation_id":"0cd87202-47a9-49e8-afa5-7e76f81eeaa4","resolution":{"observed_at":"2026-08-07T20:14:04.687378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.668336Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"5be52b2d-34a6-4e28-afb3-f2710f82e98a","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.493778Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f40b2dd6cfdb7d999543363999d858a178785214a49988674ccf9604bcb89d54","observation_id":"a782d83b-04e8-48bc-af90-12f1659a67f5","resolution":{"observed_at":"2026-08-07T20:14:04.674061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.497268Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.497268Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:0351125ef82a60f986723fa03357d393f24e9917e73a18a26a2bee85517c5555","observation_id":"70f90358-800f-43c9-af5e-83a5eaa2ddbc","resolution":{"observed_at":"2026-08-07T20:14:03.497268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.648970Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":"4032e9e3-96b3-4c16-9b4d-c82050400f4a","year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.500975Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:54928dc3a8c5325e6a3a3331f9bb8f73f942b3b335bf7819570c34296264eff5","observation_id":"cfa121c1-c60c-450b-9a2b-50e5412f6753","resolution":{"observed_at":"2026-08-07T20:14:04.652901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.636499Z","title":"Advances in Neural Information Processing Systems 36 (2024)","venue":null,"work_id":"d65543e1-e3f1-45ed-8885-bb537c85c102","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.505088Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1187ad28b3d33f6a320c3a5b74cbc9338407a53dc672bf929d15d7dc2a02ce1a","observation_id":"d98ceb0b-a543-4041-b693-10fb292f801f","resolution":{"observed_at":"2026-08-07T20:14:04.641170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.621964Z","title":"In: IEEE/CVF Computer Vision and Pattern Recognition (CVPR) (2023)","venue":null,"work_id":"1221bfe8-b7a0-4f03-bf12-f7e9cf300599","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.508994Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:1dd031323e134d95dcda7c4a1304af84637c13ca54660005209c60efa0688c50","observation_id":"cbf97497-759e-4e0e-9fc5-2fa420c9b7d4","resolution":{"observed_at":"2026-08-07T20:14:04.626627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.609969Z","title":"Neurocomputing 543, 126198 (2023)","venue":null,"work_id":"b5ff1690-8c8d-4d29-8e27-cc63857e3a3f","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.512813Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:92eac81bc662cc8f0611522774675f44fe727ba237614b6cd1da3edd2278cba8","observation_id":"985476fd-039a-40a1-ab09-2b7414acbe45","resolution":{"observed_at":"2026-08-07T20:14:04.613949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00236","last_updated":"2024-11-26T17:38:28Z","snapshot_observed_at":"2026-07-06T16:55:25.413169Z","submitted_at":"2023-11-30T22:39:23Z","title":"Brainformer: Mimic Human Visual Brain Functions to Machine Vision Models via fMRI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00236","snapshot_observed_at":"2026-08-07T20:14:03.516791Z","title":"arXiv preprint arXiv:2312.00236 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.516791Z"},"links":{"cited_paper":"/paper/2312.00236","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d36403f3aa1d396fa994a726cc82c1de6e6c501df3d4778a8b06e8f637335b05","observation_id":"e6998f3d-f3c3-4345-8da8-d72a0cb510d3","resolution":{"observed_at":"2026-08-07T20:14:03.516791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07408","last_updated":"2023-09-18T14:38:44Z","snapshot_observed_at":"2026-08-03T17:32:00.586216Z","submitted_at":"2023-04-14T21:59:32Z","title":"Fairness in Visual Clustering: A Novel Transformer Clustering Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07408","snapshot_observed_at":"2026-08-07T20:14:03.520726Z","title":"arXiv preprint arXiv:2304.07408 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.520726Z"},"links":{"cited_paper":"/paper/2304.07408","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:4988de962ef8805ae1c044fb47c7d2a072ab8d70f2b8192f27ebc8fc48d203ba","observation_id":"fd624c26-d1d7-47ad-849a-537867d8f470","resolution":{"observed_at":"2026-08-07T20:14:03.520726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.524780Z","title":"IEEE Access 8, 162973–162981 (2020) https://doi.org/10.1109/ACCESS.2020.3021469","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.524780Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:25cc7af9d761eb79adeef3f07197afb023893e265c8b6189e41daecb9a6f8f5d","observation_id":"9ef51b05-fb8d-4763-a4ad-47e9fa1a19c5","resolution":{"observed_at":"2026-08-07T20:14:03.524780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15948","last_updated":"2023-09-18T16:24:39Z","snapshot_observed_at":"2026-07-06T13:16:01.925371Z","submitted_at":"2022-05-31T16:46:51Z","title":"Two-Dimensional Quantum Material Identification via Self-Attention and Soft-labeling in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15948","snapshot_observed_at":"2026-08-07T20:14:03.528698Z","title":"arXiv preprint arXiv:2205.15948 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.528698Z"},"links":{"cited_paper":"/paper/2205.15948","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:793b816c4e635a278748fe2e6d1e63645d3f7fd15e03a88da0a4db5d4015883a","observation_id":"7a43ac72-4abf-4c73-bc86-4efbb972344c","resolution":{"observed_at":"2026-08-07T20:14:03.528698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-07T20:14:03.532719Z","title":"arXiv preprint arXiv:2106.08254 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.532719Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:42e93ab42b718e963485dd44474fbaaea19ae564ce3fe78c1302793cf61c6a8d","observation_id":"5abf39dd-5af0-4039-bf58-5c47a2fb3347","resolution":{"observed_at":"2026-08-07T20:14:03.532719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.597177Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"7c714785-aefa-4ab3-8d2f-7b661b14372d","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.537188Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:3ffbe3a5013559553bf9f9fdc7ee8c0299e47f6fa55b00566d61ef768f718d8e","observation_id":"a88b83ca-c325-4ba4-98ce-7cc988e90335","resolution":{"observed_at":"2026-08-07T20:14:04.601052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.584341Z","title":"Neurocomputing 555, 126658 (2023)","venue":null,"work_id":"0405d6fb-32b5-4db2-8ef4-4babf2d5b3c1","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.541379Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f73b9c711e475cb817c18fff2a2342571eaa20fef37f70d32a73a794ead059c2","observation_id":"1ed47745-0868-4cf4-bb40-c1bd298eaa06","resolution":{"observed_at":"2026-08-07T20:14:04.588650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10904","last_updated":"2022-05-15T23:20:46Z","snapshot_observed_at":"2026-08-06T05:59:00.316195Z","submitted_at":"2021-08-24T18:14:00Z","title":"SimVLM: Simple Visual Language Model Pretraining with Weak Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10904","snapshot_observed_at":"2026-08-07T20:14:03.546300Z","title":"arXiv preprint arXiv:2108.10904 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.546300Z"},"links":{"cited_paper":"/paper/2108.10904","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a7fb55c45bb844d2e1f6964b4fd2378ceeb8434bed94523648a564a6e382d4ed","observation_id":"8354bd25-586f-4f95-91f4-16e04aef353f","resolution":{"observed_at":"2026-08-07T20:14:03.546300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.571257Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":"7abeaa42-f2b1-4a11-913a-4d8d7c9fd6be","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.550647Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ffb2118b5fb737bc86246ecc873cb5796ff359b307324ecbd84cb9fca00cdcd6","observation_id":"d4bed51d-cfdc-4070-87cb-f2531a1e8c05","resolution":{"observed_at":"2026-08-07T20:14:04.575636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.554535Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.554535Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d3b237507142457d7e12e7713c60976b18ddd74d8fa8dfc133c5d8cf08f2dccb","observation_id":"8b52d5c1-2641-4de0-be20-31e2a79e7fef","resolution":{"observed_at":"2026-08-07T20:14:03.554535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15343","last_updated":"2023-09-27T12:05:41Z","snapshot_observed_at":"2026-07-06T15:08:30.190912Z","submitted_at":"2023-03-27T15:53:01Z","title":"Sigmoid Loss for Language Image Pre-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15343","snapshot_observed_at":"2026-08-07T20:14:03.559240Z","title":"arXiv preprint arXiv:2303.15343 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.559240Z"},"links":{"cited_paper":"/paper/2303.15343","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d3c513505b1546978e3976e6e92f8fe54b776106842e6fcf7672a8bc5e76dda2","observation_id":"642ee646-982f-416b-b8b2-1530e0ac351a","resolution":{"observed_at":"2026-08-07T20:14:03.559240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.552639Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":"2f16c39e-225f-46f7-99ab-a700c9d903c9","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.563519Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f233052488d7fe17426a5491448ea2a04bd6a45283205d4a64ee161edc6613d7","observation_id":"86bdca58-b3f7-4e08-a464-72aa6430ac95","resolution":{"observed_at":"2026-08-07T20:14:04.556691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14465","last_updated":"2023-10-09T16:55:08Z","snapshot_observed_at":"2026-07-06T15:07:56.586673Z","submitted_at":"2023-03-25T13:22:56Z","title":"Equivariant Similarity for Vision-Language Foundation Models","version":2},"cited_work":{"arxiv_id":"2303.14465","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.14465","snapshot_observed_at":"2026-08-07T20:14:04.056943Z","title":"Equivariant Similarity for Vision-Language Foundation Models","venue":"cs.CV","work_id":"b6c93a9c-fd37-4076-b924-3778a30a72c3","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.567690Z"},"links":{"cited_paper":"/paper/2303.14465","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:2265d010cb9a84f676b03f78836e1f0b9187f6c0e2d78e03cb2e40c82f0cff67","observation_id":"32c94a68-f7c5-4f3a-ad40-d73379e9ab65","resolution":{"observed_at":"2026-08-07T20:14:04.062223Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03384","last_updated":"2024-07-20T07:17:00Z","snapshot_observed_at":"2026-08-09T02:18:54.600053Z","submitted_at":"2024-04-04T11:33:29Z","title":"LongVLM: Efficient Long Video Understanding via Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03384","snapshot_observed_at":"2026-08-07T20:14:03.572391Z","title":"arXiv preprint arXiv:2404.03384 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.572391Z"},"links":{"cited_paper":"/paper/2404.03384","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7d90cb504126489bfc99e2a5b23656207cef9cb9a9e68213cdaf516d218f6a64","observation_id":"161c47bc-0c0b-41e8-80e6-744bf84cd65a","resolution":{"observed_at":"2026-08-07T20:14:03.572391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.541147Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"62bf42cc-7ca7-45d6-be15-3598e0a7e4d3","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.577128Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:845520b1358e02119625ebdad488bede56807fecc6bf52ecd7ed3dae3cb702d5","observation_id":"582fc1dd-90c0-4090-8d39-1f72238bde31","resolution":{"observed_at":"2026-08-07T20:14:04.545159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11255","last_updated":"2024-12-09T16:15:07Z","snapshot_observed_at":"2026-07-06T16:49:33.776407Z","submitted_at":"2023-11-19T06:50:52Z","title":"M$^{2}$UGen: Multi-modal Music Understanding and Generation with the Power of Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11255","snapshot_observed_at":"2026-08-07T20:14:03.581263Z","title":"arXiv preprint arXiv:2311.11255 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.581263Z"},"links":{"cited_paper":"/paper/2311.11255","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6a296cf86bbba68ce964d8c621eae40f2f45e56a1693689de65a33b27f165429","observation_id":"d2c250f6-5c41-4c7e-bc80-741c6dc3529e","resolution":{"observed_at":"2026-08-07T20:14:03.581263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13731","last_updated":"2023-05-29T12:09:08Z","snapshot_observed_at":"2026-07-06T15:20:25.388057Z","submitted_at":"2023-04-24T07:45:28Z","title":"Text-to-Audio Generation using Instruction-Tuned LLM and Latent Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13731","snapshot_observed_at":"2026-08-07T20:14:03.585698Z","title":"arXiv preprint arXiv:2304.13731 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.585698Z"},"links":{"cited_paper":"/paper/2304.13731","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:34e5d1594457efd09637e48306c3d648c3ce1b7958b7c649d53efa61eb4a3b64","observation_id":"67958216-8203-4b5c-bd0c-bd450947469c","resolution":{"observed_at":"2026-08-07T20:14:03.585698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.528664Z","title":"In: Forty-first International Conference on Machine Learning (2024)","venue":null,"work_id":"ca61f039-e3d3-482b-a15e-a1a5cf82f5a5","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.590003Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:96c79a7db3a912d5a095e5f92e1dafe8baa6a4d022799c0204b2156ace2ab691","observation_id":"b6d1d44f-d302-4645-b348-936cdee20751","resolution":{"observed_at":"2026-08-07T20:14:04.533378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.516566Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"e13f9848-9a37-4eda-bccf-d7ee9628c591","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.594254Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6ec6608979ed0c496d301f63053995a5fb6673e1819dd1e6c58adb117e361fd3","observation_id":"200dca4e-fc58-46f6-9a94-fcbb67aaa3f6","resolution":{"observed_at":"2026-08-07T20:14:04.520773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.503855Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"f91eab89-8a69-48ec-9a05-52841909a13d","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.598138Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:15fec278491dd75728aa10ba49030587157714b14e2998d954c53850a7bc3d90","observation_id":"8f6c6d70-3e65-44df-bd24-53fd20099a84","resolution":{"observed_at":"2026-08-07T20:14:04.508061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.492371Z","title":"In: The Thirty-eighth Annual Conference on Neural Information Processing Systems (2024)","venue":null,"work_id":"a99202eb-4a63-4f80-ab73-fe7b4256e94c","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.601936Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:a5c0dc6931e32a289d618d08db5e220d2df9ef152dc2346373497cdc3a7f4316","observation_id":"897f8c92-e513-4537-84fe-21a8adad5eeb","resolution":{"observed_at":"2026-08-07T20:14:04.496417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.480274Z","title":"CoRR (2024)","venue":null,"work_id":"1abddf6e-01aa-4259-8dad-ee77626c5a8c","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.605957Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:e956737ec88a886c8d6955b68e7e4b1402c6b4cb97364ed8419df40126b8b85f","observation_id":"c622d869-1810-4521-b96f-76c52711a8d5","resolution":{"observed_at":"2026-08-07T20:14:04.484369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.468384Z","title":"In: Proceedings of the International Conference on Machine Learning, pp","venue":null,"work_id":"14e68dcb-77e7-4098-afcb-1e9e804cd3d0","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.609938Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:6498a02abc445d8a2eaec66e7a009e8fcad996de3af354931b03c86a75908e49","observation_id":"574b456c-475c-4b67-b341-7e3e1cd21c5f","resolution":{"observed_at":"2026-08-07T20:14:04.472555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.454186Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"f73c09fc-fd37-4c06-a67b-0636165e3e7b","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.613777Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d15a894ee59978aebbe6bfde2edd31b0487681db2ea399d22110082ead74f7a0","observation_id":"592462bf-1bb1-4fb9-b3c0-84dea7de25f3","resolution":{"observed_at":"2026-08-07T20:14:04.459548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.17126","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.996438Z","title":"arXiv preprint arXiv:2406.17126 (2024)","venue":null,"work_id":"0b846621-a6b8-4873-8883-8dc3e874bf05","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.617630Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:128211da2dfaaeac36a82cda350e90c5d2917ba9fa33d7024721fdf49980abd1","observation_id":"eb652122-9dec-4c93-a967-31844d1630a7","resolution":{"observed_at":"2026-08-07T20:14:04.003496Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T20:14:03.621496Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.621496Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:9ed3fff6b83cef09336b25ba225926aa870b6964577b44881408a9bda627308f","observation_id":"070dc3b6-422a-42ee-9df5-bdde0504d3f4","resolution":{"observed_at":"2026-08-07T20:14:03.621496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T20:14:03.625538Z","title":"arXiv preprint arXiv:2407.21783 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.625538Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:558e6cba8a3edcef378258bd5294d75136a4910ee433975307bf6153ba9729c0","observation_id":"e9182a25-21a3-4958-9218-d948af5673f7","resolution":{"observed_at":"2026-08-07T20:14:03.625538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.442293Z","title":"https://lmsys","venue":null,"work_id":"b0abea90-5e8c-44ee-9c26-2560e11a0e5d","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.629514Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b633f43056508f9f80c69b3ff5e2f77907c6b0e2cd4633aefee4463303651fed","observation_id":"7ed24c0c-a9cd-4bac-91ee-d780eaf15cae","resolution":{"observed_at":"2026-08-07T20:14:04.446296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.430551Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":"f06816af-0ab4-4b90-8496-83b8e69c4e10","year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.633267Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:bc3f853a9c99df859a64617dcd2beee4955787bf68daf05757c23edb12991fe5","observation_id":"98ff88bf-5520-4493-8176-e7bbb2f83a52","resolution":{"observed_at":"2026-08-07T20:14:04.434532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T20:14:03.637273Z","title":"arXiv preprint arXiv:1810.04805 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.637273Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f3768ac83dd6cdd4856dddf80d08fb51ab197ca3a4a9d92c32da043bae224c23","observation_id":"16d22215-91a3-4474-b89b-9d5aa161b86d","resolution":{"observed_at":"2026-08-07T20:14:03.637273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T20:14:03.641330Z","title":"arXiv preprint arXiv:1907.11692 (2019) 37","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.641330Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:c737ed72f0b647628816d73cb192c6dc3ac7a42a3fe63810ab6a5cb9758338f8","observation_id":"6603f105-db56-4e5d-b2b6-7e3b358047a1","resolution":{"observed_at":"2026-08-07T20:14:03.641330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-07T20:14:03.645396Z","title":"arXiv preprint arXiv:1910.13461 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.645396Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:99ba1a2bacb590bf88125c42e1b384e1b5298fae265628f3c8a4aa9e505e6c4b","observation_id":"d2f3e40d-5857-4eb8-a846-b4d5683a2e18","resolution":{"observed_at":"2026-08-07T20:14:03.645396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.417962Z","title":"The Journal of Machine Learning Research 21(1), 5485–5551 (2020)","venue":null,"work_id":"9630d141-03d9-4458-92cb-847660a8d4ce","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.649319Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:5202066c5f0d5713cad946e5e3ec752b616ff8d0ee7f7335526b531453c482e0","observation_id":"85238194-590d-48e3-bf1c-4ef3c8f58eca","resolution":{"observed_at":"2026-08-07T20:14:04.422533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.405216Z","title":"In: The 36th Conference on Neural Information Processing Systems (NeurIPS) (2022)","venue":null,"work_id":"210481c6-a3a2-4eb9-9a52-bb46e93726bb","year":2022},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.652991Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d47f64d421b6cdcfce2df20d63ac1418fccd80c1dc9efe473689d06fc232eef9","observation_id":"7f79209d-9632-4306-936b-816f94c831b6","resolution":{"observed_at":"2026-08-07T20:14:04.409160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.656494Z","title":"In: Computer Vision–ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6-12, 2014, Proceedings, Part V 13, pp","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.656494Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:b5ae025336d7795d19178f54570d2579be09b3eb8b837ece4789eceef19f92dc","observation_id":"a91d7833-9a26-486d-8382-5ad0749360d8","resolution":{"observed_at":"2026-08-07T20:14:03.656494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T20:14:03.660620Z","title":"arXiv preprint arXiv:2010.11929 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.660620Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:941d40401208026d04af8bab47ba92debc45b366dd901c80230e627570e59c80","observation_id":"87fe93ee-a9c7-4f1f-9747-2a666074f691","resolution":{"observed_at":"2026-08-07T20:14:03.660620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.665008Z","title":"Advances in neural information processing systems 32 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.665008Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f216fa33c03b06407ab621904a9d043649c16982ce163e6d1d444184d928d19d","observation_id":"8ad4aefc-1360-452b-89ab-1c30a59765fe","resolution":{"observed_at":"2026-08-07T20:14:03.665008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-07T20:14:03.669260Z","title":"arXiv preprint arXiv:1608.03983 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.669260Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7e0cfd12d3a5f1d29ac233411763287718ec627f559cd74ad2b1f650a9f8a442","observation_id":"585bcfba-6127-4287-99e4-9c8c7d4b0359","resolution":{"observed_at":"2026-08-07T20:14:03.669260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T20:14:03.672971Z","title":"arXiv preprint arXiv:1711.05101 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.672971Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:c201abb90776fc8a871d2717c2b1cd37a4422f51980a84404c3223cd823623de","observation_id":"7c3fe678-de6f-4ae0-9604-093baa1f19b0","resolution":{"observed_at":"2026-08-07T20:14:03.672971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.377950Z","title":"Ecological Informatics 57, 101089 (2020)","venue":null,"work_id":"c99f4923-e6b4-40c8-9b45-f35af079575d","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.676820Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:f13c4104bcacd64adfd2ec42badf53787da7ffd3fa82a29e09463a15a17594b1","observation_id":"20362330-ac9a-4890-993a-c9c13e99d4eb","resolution":{"observed_at":"2026-08-07T20:14:04.382623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.365699Z","title":"Computers and Electronics in Agriculture 179, 105809 (2020)","venue":null,"work_id":"c3620ad2-32b3-47d7-8046-9f3e86b345e3","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.680409Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:d88bf50e94259c4ccad4aaa8651ab6b3f8d53b1c37c6167b85d726622430c075","observation_id":"a38f9ea5-5cab-4941-8e41-4ec10a5b3816","resolution":{"observed_at":"2026-08-07T20:14:04.369454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.354181Z","title":"Advances in Neural Information Processing Systems 36 (2024) 38","venue":null,"work_id":"616ae6fa-9131-4301-bd18-43c8e66ecb8d","year":2024},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.684817Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:909efda74b1792070271cdb34ee1c104985fa7933e7781b39b18a796a27a46aa","observation_id":"71235bfb-490d-43a1-b39e-e0ad895aa6a7","resolution":{"observed_at":"2026-08-07T20:14:04.358652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.342980Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"b6037dbf-05ed-4411-bdf4-bdebe075ae4b","year":2020},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.689192Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:ac35cd347e4360c4480a366f67ddad0ff9b0d6cdca40de8caf68af5ddc65d927","observation_id":"09d034ec-e1d5-4a82-8f2c-785706d91386","resolution":{"observed_at":"2026-08-07T20:14:04.346597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.331235Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"6409c710-cc01-4a47-ad9c-f3741088d981","year":2023},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.693354Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:863e1ee4126687bf42b25c3b46e1208b620cefac5e79889702c195d20f1e4411","observation_id":"efa211a4-88e4-433b-bf97-a544a45202bd","resolution":{"observed_at":"2026-08-07T20:14:04.335292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:04.319518Z","title":"Advances in neural information processing systems 25 (2012)","venue":null,"work_id":"eba42c9a-5e10-4755-a0d9-299851b240fd","year":2012},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.697682Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:9d53dfb419d34c61304d2d1bf07e23592814187c9cd5e64659b7de99ed0651de","observation_id":"e3a6f0e1-a677-456a-95ed-91b27553c8c8","resolution":{"observed_at":"2026-08-07T20:14:04.323380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.701689Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.701689Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:5f9e1c7486ce19d5f6789684211fe50cee49a0f8c5aa2b08f29ed1c3796fd90f","observation_id":"435d2fe2-f715-424f-8401-0fd417eef4d7","resolution":{"observed_at":"2026-08-07T20:14:03.701689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-07T20:14:03.705597Z","title":"arXiv preprint arXiv:1409.1556 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.705597Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:566eefa8a4a6c951341bf6a9dc882024aa0786844e991eb8fb4b4d6ed5709464","observation_id":"c7f58662-8ffc-4853-baa9-37a54daa6074","resolution":{"observed_at":"2026-08-07T20:14:03.705597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:14:03.709995Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T20:14:03.709995Z"},"links":{"citing_paper":"/paper/2502.09906"},"observation_digest":"sha256:7bea0439ec95a6ad15f5d960ea0915201bfce4602e352f38c87ad8f16d9454e5","observation_id":"90bafd51-0017-45c0-b8bf-691396cd3a62","resolution":{"observed_at":"2026-08-07T20:14:03.709995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.09906","last_updated":"2025-02-14T04:29:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T03:56:12.937915Z","submitted_at":"2025-02-14T04:29:17Z","title":"Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":63,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":105},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 105 outbound references and 1 inbound Pith citation observation for arXiv:2502.09906."}