{"as_of":"2026-08-21T17:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b55e802462a07fd8525f6b656fe8d1795a74db3a2d261d9761fd6ad0d3599345","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:02:10.476459Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:05:38.824441Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T16:05:39.266280Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"cited_work":{"arxiv_id":"2505.08838","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.08838","snapshot_observed_at":"2026-08-05T16:05:39.266280Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","venue":"eess.IV","work_id":"67804689-96fa-4f8c-afdf-e26b44473a9c","year":2025},"citing_paper":{"arxiv_id":"2508.19319","last_updated":"2025-08-26T13:31:01Z","snapshot_observed_at":"2026-08-15T14:05:00.987607Z","submitted_at":"2025-08-26T13:31:01Z","title":"MedVQA-TREE: A Multimodal Reasoning and Retrieval Framework for Sarcopenia Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T16:05:38.824441Z"},"links":{"cited_paper":"/paper/2505.08838","citing_paper":"/paper/2508.19319"},"observation_digest":"sha256:205af41ad84db1b07b57c0e305ce77d70ace5c19ac9dd0828ec7b5b659f79ea3","observation_id":"b97c11a8-40d4-4461-bf5e-ed3c5e29b4ae","resolution":{"observed_at":"2026-08-05T16:05:39.271806Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.08838/citation-record","integrity":"/paper/2505.08838/integrity","json":"/paper/2505.08838/citation-record.json","paper":"/paper/2505.08838"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-16T13:39:01.243847Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-15T22:02:10.384396Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.384396Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:7901c4537775072160e0afcc6e6e254007e6edf82013ff339d44f2cd40af9838","observation_id":"0aae5dd9-3380-4448-8881-2bbf1da15a07","resolution":{"observed_at":"2026-08-15T22:02:10.384396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-15T22:02:10.389112Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.389112Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:69b5a1c95bcf182cb0f3171cccb418549e14815b7c81723c61faa6fb4473a1a8","observation_id":"3b5a57fb-aa68-4ef2-adba-040884db1da1","resolution":{"observed_at":"2026-08-15T22:02:10.389112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.392843Z","title":"In: Burstein, J., Doran, C., Solorio, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.392843Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:c2ecc3a32fabee1bb554dfa66b6064625a5a210cc957362adf8b4e4ac33479e4","observation_id":"ce2cee0c-47f5-4cee-9338-57753fb0cf2f","resolution":{"observed_at":"2026-08-15T22:02:10.392843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T22:02:10.396677Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.396677Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:c198a724f2e1e62163f504a8bd16867440bee784eb4a0001782004ccf30dfc1d","observation_id":"96a23322-e324-43f5-b58f-5daaf22abd4c","resolution":{"observed_at":"2026-08-15T22:02:10.396677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-15T22:02:10.401584Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.401584Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:8b7465c0cc1da60e3e145b72147ec0943a6f4f7361e1cef793dd40ca2e8b3c42","observation_id":"ba630cdb-5387-4109-a902-3af8551200f0","resolution":{"observed_at":"2026-08-15T22:02:10.401584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03013","last_updated":"2023-12-05T00:28:26Z","snapshot_observed_at":"2026-08-16T23:31:27.673414Z","submitted_at":"2023-12-05T00:28:26Z","title":"Breast Ultrasound Report Generation using LangChain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03013","snapshot_observed_at":"2026-08-15T22:02:10.406305Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.406305Z"},"links":{"cited_paper":"/paper/2312.03013","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:7bc921daf0c34186fefd56b2845d2c8b3d6810355d674b83f3a7114d27553b3e","observation_id":"4a77b202-7056-4489-9523-f0468f4c5e9b","resolution":{"observed_at":"2026-08-15T22:02:10.406305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-15T22:02:10.411362Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.411362Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:31fd8aa86fef6581e4b4c65ab168dd3aed6c6f50feb002a7405b1c7441f3232d","observation_id":"991aae31-998d-4bb3-8369-929b234b4bf7","resolution":{"observed_at":"2026-08-15T22:02:10.411362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:11.050961Z","title":"In: Wang, L., Dou, Q., Fletcher, P.T., Speidel, S., Li, S","venue":null,"work_id":"dd2654ee-d574-4909-b497-35b2e7960b25","year":2022},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.415898Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:2fc8eccf82024465b7734320776f6d554304d0dfef2e31fd6d2b697b4ebc5c65","observation_id":"acc6979b-fc13-40db-844f-03201b66524d","resolution":{"observed_at":"2026-08-15T22:02:11.056188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.420148Z","title":"IEEE Transactions on Medical Imaging44(1), 19–30 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.420148Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:828e2286f74c45b8575793be935821e56bea12d3958a1871d9d99b78566cc63c","observation_id":"3b2d3a42-377d-492d-ba7a-68d4b0223335","resolution":{"observed_at":"2026-08-15T22:02:10.420148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.424424Z","title":"In: Text Summarization Branches Out","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.424424Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:e742ec2bdd1fd21609b70f0680750260c35c1e456eada22d0462477ce15f88a9","observation_id":"8eea392b-c4e0-4d37-b2cf-0c0b6a94dabc","resolution":{"observed_at":"2026-08-15T22:02:10.424424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.428526Z","title":"Proceedings of the AAAI 10 P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.428526Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:a7ac96f7c0d01c98f1f68da71371cede9116eec8dd6c258b227e820ffe53c0f3","observation_id":"3343e174-41ce-4c39-8981-3adc0847add0","resolution":{"observed_at":"2026-08-15T22:02:10.428526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-15T22:02:10.433161Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.433161Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:ed659fc1085d5b823ba85f5a71f2c951db6679aac4c3358df2509f7d696d7649","observation_id":"2565770d-3612-4fcf-add1-a310630c47b7","resolution":{"observed_at":"2026-08-15T22:02:10.433161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.438097Z","title":"In: Proceedings of the 40th Annual Meeting on Asso- ciation for Computational Linguistics","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.438097Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:ae55cf4df645406b49e58ce6df9e4e1bf5b36fe6f03ab40843079094a7391f60","observation_id":"32ce6bda-b944-40ee-ac93-e7f453997f0b","resolution":{"observed_at":"2026-08-15T22:02:10.438097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.442970Z","title":"In: Muresan, S., Nakov, P., Villavicencio, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.442970Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:6db96396e2efb0c25b05c7a83a4d90f687efcd6e40626f5b44e726016383b095","observation_id":"9b0f9f87-ab27-40e4-91e4-e5db97786a9d","resolution":{"observed_at":"2026-08-15T22:02:10.442970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.446929Z","title":"IEEE Reviews in Biomedical Engineering pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.446929Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:60ff3f68521b0d6d909677bf6232bf42ffd520e484be3486e6f4ae83bf24e23f","observation_id":"cb855251-7bc2-46d8-9e27-70ab97b7e0ef","resolution":{"observed_at":"2026-08-15T22:02:10.446929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.450930Z","title":"In: 2015 IEEE Conference on Com- puter Vision and Pattern Recognition (CVPR)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.450930Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:e920e07365d7e205c2cd21ff2622a0bab9cc8f4e2be5b9bc6ab6c56f33dbe707","observation_id":"d670180c-8447-4805-a1b6-effc8cae80a3","resolution":{"observed_at":"2026-08-15T22:02:10.450930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.454993Z","title":"Artificial Intelligence Review57(11) (Sep 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.454993Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:36ec87241bf2a9e2a5496065254896f2c3e5f348d01d3c033aed6b8d54816bad","observation_id":"8932e246-6cc3-496b-bee8-328fa75bc044","resolution":{"observed_at":"2026-08-15T22:02:10.454993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-15T22:02:10.459364Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.459364Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:46a928df92baa4f2e946c34581ffc653232b4a3812a747485fd1aba4e74ab556","observation_id":"a29645bd-6f6e-49ef-bafe-30865e66a1e5","resolution":{"observed_at":"2026-08-15T22:02:10.459364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:11.027922Z","title":"In: Proceedings of EMNLP 2020: System Demonstra- tions","venue":null,"work_id":"b2349447-2101-4037-9aff-dd2134740712","year":2020},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.463759Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:80dfa4283780dd28f5f07ece37ff4073c436ca1a9ceaddc1280a4cc331b42338","observation_id":"07c6a001-2935-4249-af39-62ec35240c54","resolution":{"observed_at":"2026-08-15T22:02:11.032274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13229","last_updated":"2022-11-12T07:41:03Z","snapshot_observed_at":"2026-08-19T13:04:08.540192Z","submitted_at":"2022-11-12T07:41:03Z","title":"DeltaNet:Conditional Medical Report Generation for COVID-19 Diagnosis","version":1},"cited_work":{"arxiv_id":"2211.13229","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.13229","snapshot_observed_at":"2026-08-15T22:02:10.634082Z","title":"DeltaNet:Conditional Medical Report Generation for COVID-19 Diagnosis","venue":"eess.IV","work_id":"c5f612c0-74a4-40a9-8616-377915c143de","year":2022},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.467634Z"},"links":{"cited_paper":"/paper/2211.13229","citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:2a50b5ca521017afe287905bb005440cbfd85c2146af582393ce6c4a3a7084cd","observation_id":"219cc6d8-88c4-4e86-b426-683a9dd33df1","resolution":{"observed_at":"2026-08-15T22:02:10.639991Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.neucom.2020.09.084","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.506009Z","title":"Neurocomputing 427, 40–49 (2021)","venue":null,"work_id":"1bb7ce10-3241-4fdf-877e-8324e54e4176","year":2021},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.472150Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:d47239010e75e88b1dd10b270ce7bc291aec71b54299bcbcefdf199a033cd7c8","observation_id":"30dcdc89-d4ae-4040-b766-f5e06fd034c6","resolution":{"observed_at":"2026-08-15T22:02:10.511704Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:02:10.476459Z","title":"Artificial Intelligence in Medicine151, 102846 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:02:10.476459Z"},"links":{"citing_paper":"/paper/2505.08838"},"observation_digest":"sha256:c1dced0b3048dc871c2174a09fc0a29f63078e1ad8a25d953edc39f11866bc6c","observation_id":"0b2cfd8f-dc8a-4de5-85a7-369ccc2e0974","resolution":{"observed_at":"2026-08-15T22:02:10.476459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.08838","last_updated":"2025-05-19T04:30:42Z","latest_version":2,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-16T13:39:20.979186Z","submitted_at":"2025-05-13T08:27:01Z","title":"Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2505.08838."}