{"as_of":"2026-08-11T13:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a2c32e9e4bc61872a88fb253b469238178c22f25cc536c5bbde48e291fa717a","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:43:25.919378Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.04138/citation-record","integrity":"/paper/2501.04138/integrity","json":"/paper/2501.04138/citation-record.json","paper":"/paper/2501.04138"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:43:26.550907Z","title":"In Findings of the Association for Computational Linguistics: ACL 2023, pages 8256–","venue":null,"work_id":"f30b8d1b-2eb1-441b-87d6-0a6c160e0278","year":2023},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.456995Z"},"links":{"citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:bd912df55cce1e37aa5accf20cdb533acb4bcb722b41624e22d660987944a6d6","observation_id":"fbe93ba6-5467-474e-b398-ce14c6bd1447","resolution":{"observed_at":"2026-08-10T21:43:26.557221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-10T21:43:25.469157Z","title":"arXiv preprint arXiv:2311.07919","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.469157Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:b9ca73f38d7c459f25ce23479851f2232fe4debdaa07a38ae1675be718c0312b","observation_id":"9a741e32-a20c-4f9e-b086-c03cf1679886","resolution":{"observed_at":"2026-08-10T21:43:25.469157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17924","last_updated":"2023-10-27T06:48:48Z","snapshot_observed_at":"2026-08-10T23:14:08.689503Z","submitted_at":"2023-10-27T06:48:48Z","title":"SOUL: Towards Sentiment and Opinion Understanding of Language","version":1},"cited_work":{"arxiv_id":"2310.17924","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.17924","snapshot_observed_at":"2026-08-10T21:43:26.157620Z","title":"SOUL: Towards Sentiment and Opinion Understanding of Language","venue":"cs.CL","work_id":"97c9b139-ff9b-4c8d-8fb1-b4190b507645","year":2023},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.515987Z"},"links":{"cited_paper":"/paper/2310.17924","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:9d62a507c2577aa0e59d6a0d0685e635d0f28c960d6a9d122181e1ca426039a2","observation_id":"eff4710e-d4fb-46b2-9c86-fd29ee8bec99","resolution":{"observed_at":"2026-08-10T21:43:26.179670Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06910","last_updated":"2024-01-09T11:45:34Z","snapshot_observed_at":"2026-08-11T07:56:59.104094Z","submitted_at":"2023-04-14T03:25:00Z","title":"HCAM -- Hierarchical Cross Attention Model for Multi-modal Emotion Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06910","snapshot_observed_at":"2026-08-10T21:43:25.555945Z","title":"arXiv preprint arXiv:2304.06910","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.555945Z"},"links":{"cited_paper":"/paper/2304.06910","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:7c996bbe4c6adcd67ec321ca18655c4d8568c34dfdb897400ce60616c37dbaca","observation_id":"0b73e684-7f8d-436d-b5c3-da0daa631ca5","resolution":{"observed_at":"2026-08-10T21:43:25.555945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10790","last_updated":"2024-02-19T23:51:49Z","snapshot_observed_at":"2026-08-10T23:13:19.587008Z","submitted_at":"2023-05-18T08:03:37Z","title":"Listen, Think, and Understand","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10790","snapshot_observed_at":"2026-08-10T21:43:25.603086Z","title":"arXiv preprint arXiv:2305.10790","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.603086Z"},"links":{"cited_paper":"/paper/2305.10790","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:c09ada37e6aace67456affd6859d38bcc68e0d891cf75b133ce12c4574b2978e","observation_id":"3bbf07de-fedf-4d76-9bbd-affcaac80e81","resolution":{"observed_at":"2026-08-10T21:43:25.603086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:43:26.426846Z","title":"In Findings of the Association for Computational Linguistics: EMNLP 2022, pages 289–299","venue":null,"work_id":"5952701e-ebca-4597-b4ad-c3b13b35c1ef","year":2022},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.720846Z"},"links":{"citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:5d584ef0c9a448a8a0b7034c05b2170b2f424d4753cc1d20afa1f89deaf45960","observation_id":"6b02cde4-29bc-4008-8bf1-e461ac3a7622","resolution":{"observed_at":"2026-08-10T21:43:26.496325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01368","last_updated":"2021-12-02T16:09:33Z","snapshot_observed_at":"2026-08-03T21:34:51.089550Z","submitted_at":"2021-12-02T16:09:33Z","title":"ScaleVLAD: Improving Multimodal Sentiment Analysis via Multi-Scale Fusion of Locally Descriptors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01368","snapshot_observed_at":"2026-08-10T21:43:25.752770Z","title":"arXiv preprint arXiv:2112.01368","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.752770Z"},"links":{"cited_paper":"/paper/2112.01368","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:829c0cb9e7aa79dc9839e12b91ea05fdd0096339471c2171d0b5d4006ab29116","observation_id":"4b541765-0c3c-4d42-a69a-154dc9cf24e5","resolution":{"observed_at":"2026-08-10T21:43:25.752770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:43:26.415208Z","title":"In 2021 IEEE Automatic Speech Recognition and Understanding Workshop (ASRU), pages 350–357","venue":null,"work_id":"165b431f-1cf5-42e7-b388-bf810c5cfc4a","year":2021},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.757190Z"},"links":{"citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:0d327dbc6eb67767a92b930e566fbc254b10ae573be86f202b49223832e9521c","observation_id":"fab8e1db-5c1d-46bc-8eb5-111a0a484aa2","resolution":{"observed_at":"2026-08-10T21:43:26.418865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12441","last_updated":"2022-03-23T14:28:08Z","snapshot_observed_at":"2026-08-09T20:09:10.830261Z","submitted_at":"2022-03-23T14:28:08Z","title":"M-SENA: An Integrated Platform for Multimodal Sentiment Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12441","snapshot_observed_at":"2026-08-10T21:43:25.768375Z","title":"arXiv preprint arXiv:2203.12441","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.768375Z"},"links":{"cited_paper":"/paper/2203.12441","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:1eda03ff6250f04dfb2589767919531420ce6faffdd8ca9a9bc2a922f2e8e28e","observation_id":"833f3756-dcad-4d1f-bb05-ed4b27f1e90c","resolution":{"observed_at":"2026-08-10T21:43:25.768375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03502","last_updated":"2021-04-08T04:31:58Z","snapshot_observed_at":"2026-07-06T10:57:30.968546Z","submitted_at":"2021-04-08T04:31:58Z","title":"Emotion Recognition from Speech Using Wav2vec 2.0 Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.03502","snapshot_observed_at":"2026-08-10T21:43:25.777825Z","title":"arXiv preprint arXiv:2104.03502","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.777825Z"},"links":{"cited_paper":"/paper/2104.03502","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:355a41536add30b7c7dabd70248429c69f1932ded9197c49fe67e36d35bb5aa0","observation_id":"14e7e7f4-71bc-43d2-b84b-6a49421b81c4","resolution":{"observed_at":"2026-08-10T21:43:25.777825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T21:43:25.789415Z","title":"arXiv preprint arXiv:2307.09288","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.789415Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:d87341aed54e2bf19e35971e2e98193dbf4671ed3607a55559efbbdff2b2ae5f","observation_id":"7da15da4-8ca4-4a91-9553-8bb79d6e8d48","resolution":{"observed_at":"2026-08-10T21:43:25.789415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04339","last_updated":"2024-02-17T10:08:06Z","snapshot_observed_at":"2026-08-10T14:37:01.564142Z","submitted_at":"2023-04-10T00:55:59Z","title":"Is ChatGPT a Good Sentiment Analyzer? A Preliminary Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04339","snapshot_observed_at":"2026-08-10T21:43:25.796331Z","title":"arXiv preprint arXiv:2304.04339","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.796331Z"},"links":{"cited_paper":"/paper/2304.04339","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:69fba943fba61e9d97311f2fb24b5f0dcd4be7b86f4ee52d46e67daca377b952","observation_id":"4a195208-744b-4aa3-8dba-b2d9d432ceb3","resolution":{"observed_at":"2026-08-10T21:43:25.796331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-10T21:43:25.919378Z","title":"It’s okay if you don’t like me. Not everyone has similar preferences in the type of people they are partial to","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.919378Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:83bbdc95a1485a6899fd05b7551da128548d8050faf2944f02dac9042057e1f1","observation_id":"701acd15-b9f8-43d1-988f-e0bbbf381a75","resolution":{"observed_at":"2026-08-10T21:43:25.919378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:43:26.262955Z","title":"In 2017 IEEE International Conference on Multimedia and Expo (ICME), pages 949–954","venue":null,"work_id":"1c183917-acaa-40bf-ba52-8f4f68b42b48","year":2017},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.793068Z"},"links":{"citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:07398ffa8faacf6041d88e7eff133d434ea599c454746390361958ddeabc1206","observation_id":"1794769f-95d4-4e71-a7a3-3382b4541830","resolution":{"observed_at":"2026-08-10T21:43:26.324957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:43:26.232326Z","title":"In Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing","venue":null,"work_id":"b74e8dfa-757b-4693-be52-e05443ae187c","year":2019},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.848604Z"},"links":{"citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:6ee7de9d96af574ca056566eadead7e1c7635dc97240c5e899d9759f43be6e7f","observation_id":"ae462fc6-3f3d-46a8-8220-381f37b7d077","resolution":{"observed_at":"2026-08-10T21:43:26.236757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:43:26.375064Z","title":"BERT-Like","venue":null,"work_id":"3b571ec6-21e1-4636-a462-66f05087b2ec","year":2020},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.786413Z"},"links":{"citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:a90c2b9c0352d02f2fdfb36c65f2d3a029569855153f92901de90a557b53ec86","observation_id":"9fe3bd8c-7d49-46c8-aae1-33d8ad25675e","resolution":{"observed_at":"2026-08-10T21:43:26.396574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00412","last_updated":"2021-09-16T08:32:03Z","snapshot_observed_at":"2026-08-09T19:44:37.485389Z","submitted_at":"2021-09-01T14:45:16Z","title":"Improving Multimodal Fusion with Hierarchical Mutual Information Maximization for Multimodal Sentiment Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00412","snapshot_observed_at":"2026-08-10T21:43:25.649485Z","title":"arXiv preprint arXiv:2109.00412","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.649485Z"},"links":{"cited_paper":"/paper/2109.00412","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:4f6bc39637ea6d90a018bb75c795a04b1ce89c69ae9ef650ed006c9309f9da2b","observation_id":"ed06ba36-3c5f-4a30-a177-9fd74326803c","resolution":{"observed_at":"2026-08-10T21:43:25.649485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:43:26.511396Z","title":"In Findings of the Association for Computational Linguistics: EMNLP 2022, pages 5105–5114","venue":null,"work_id":"a314e848-44f5-4503-bda2-2b796e0a8798","year":2022},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.465275Z"},"links":{"citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:9f727f7b5c3de147bdd927cc043119392130047989338d7ce90480797cccea48","observation_id":"854d5b97-c836-4351-8eeb-af833e40746b","resolution":{"observed_at":"2026-08-10T21:43:26.529333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T21:43:25.417581Z","title":"arXiv preprint arXiv:2303.08774","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.417581Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:9f7581c32c3014999422a5e064a4794aee08f22cfe380ab9b64fc8d06dbe3d58","observation_id":"3edb7c4c-1dc7-4ede-ba0b-c6e8dbaf03a9","resolution":{"observed_at":"2026-08-10T21:43:25.417581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05045","last_updated":"2024-03-08T04:44:25Z","snapshot_observed_at":"2026-08-11T08:21:13.631906Z","submitted_at":"2024-03-08T04:44:25Z","title":"Are Human Conversations Special? A Large Language Model Perspective","version":1},"cited_work":{"arxiv_id":"2403.05045","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.05045","snapshot_observed_at":"2026-08-10T21:43:26.070989Z","title":"Are Human Conversations Special? A Large Language Model Perspective","venue":"cs.CL","work_id":"c5979933-8bdb-4f04-a91f-cefa3e32b5ff","year":2024},"citing_paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T21:43:25.689842Z"},"links":{"cited_paper":"/paper/2403.05045","citing_paper":"/paper/2501.04138"},"observation_digest":"sha256:b5100e1ff28d17cd2e1dbac1d6bebd4319309b38c8aa0adb877a41ae4a601e5e","observation_id":"45535fc0-2535-4a72-b57c-11c0815b15bc","resolution":{"observed_at":"2026-08-10T21:43:26.089463Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.04138","last_updated":"2025-01-07T20:57:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T21:38:15.954120Z","submitted_at":"2025-01-07T20:57:59Z","title":"\"Yeah Right!\" -- Do LLMs Exhibit Multimodal Feature Transfer?"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2501.04138."}