{"as_of":"2026-08-09T17:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:648b27ed09cfcfacb053dfc1564c8d6a346e02475881905ecaef4aaf15d3f70d","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:42:31.204167Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01020/citation-record","integrity":"/paper/2608.01020/integrity","json":"/paper/2608.01020/citation-record.json","paper":"/paper/2608.01020"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:36.414689Z","title":"Unveiling the vulnerability of private fine-tuning in split-based frameworks for large language models: A bidirectionally enhanced attack,","venue":null,"work_id":"a58d0368-cc71-45ce-8a30-e22422b78693","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.115305Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:2b0fafd79c8e0f3e5efe8654eedf48eb7ebb305fe9c7834c8e378ce4b0eeaeb2","observation_id":"900cffbb-e600-405b-8aad-74454c91c20c","resolution":{"observed_at":"2026-08-06T00:42:36.535555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:28.176827Z","title":"Language models are injective and hence invertible,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.176827Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:fc44178630e84ffa008b772d42d8a7b8990d92a93e5a6f65c2a215a6c55e1f8e","observation_id":"84e0f646-4a1b-49e5-98eb-508f98222372","resolution":{"observed_at":"2026-08-06T00:42:28.176827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.06571","last_updated":"2026-05-08T15:19:37Z","snapshot_observed_at":"2026-07-06T22:35:18.393401Z","submitted_at":"2025-11-09T23:18:36Z","title":"Rep2Text: Decoding Full Text from a Single LLM Token Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.06571","snapshot_observed_at":"2026-08-06T00:42:28.276638Z","title":"Rep2text: Decoding full text from a single llm token representation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.276638Z"},"links":{"cited_paper":"/paper/2511.06571","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:fcda0bc121f43f7514c68e3474120d894292f72d2bf1f45f6e8f687503abd51f","observation_id":"fa2d9e2b-9f56-47c0-b295-9c83ff0f1bee","resolution":{"observed_at":"2026-08-06T00:42:28.276638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:36.095795Z","title":"Inverting visual representations with convolutional networks,","venue":null,"work_id":"de98b59c-89e6-47ef-bdee-99fd4385e1ee","year":2016},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.385825Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:615602c5d3a2ee7dd9c1aa9e03a8ed1372327a7e74b85a744a6520941c1f8b36","observation_id":"b902e04b-11a7-4ddd-bc4e-ec9aafd3e5dd","resolution":{"observed_at":"2026-08-06T00:42:36.267438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06534","last_updated":"2025-08-13T18:10:14Z","snapshot_observed_at":"2026-08-09T03:39:39.582274Z","submitted_at":"2024-12-09T14:43:06Z","title":"Understanding Transformer-based Vision Models through Inversion","version":4},"cited_work":{"arxiv_id":"2412.06534","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06534","snapshot_observed_at":"2026-08-06T00:42:31.527823Z","title":"Understanding Transformer-based Vision Models through Inversion","venue":"cs.CV","work_id":"79e1827f-0563-4aff-9a9b-a76c527f7a94","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.469693Z"},"links":{"cited_paper":"/paper/2412.06534","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:e1fd21b9d2f4476a2fa2adc43b67adbb61e780f81469edac2ba83d2be840f1d7","observation_id":"2667750d-a3e5-4318-8149-30205dfe0dc6","resolution":{"observed_at":"2026-08-06T00:42:31.570046Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.815990Z","title":"Sparse model inversion: efficient inversion of vision transformers for data-free applications,","venue":null,"work_id":"533c02ad-10ba-48f5-99b5-cf4ca2b75425","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.556824Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:8500dd7806ac837044da97b650d9703db62b0e7fe3a97c8148e9f056c4fc1255","observation_id":"735f549d-dd75-458b-92c0-62d145269e18","resolution":{"observed_at":"2026-08-06T00:42:35.926981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.634997Z","title":"A survey of attacks on large vi- sion–language models: Resources, advances, and future trends,","venue":null,"work_id":"d5813c3a-62ce-45aa-95c6-7d23cac8282d","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.659787Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:a333886b707213b392495e18ba6130aa9f9522bf19ade9cfac9cadd91395cccd","observation_id":"f6e854a5-7f5f-492c-8469-acbc6172cb43","resolution":{"observed_at":"2026-08-06T00:42:35.737572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.359265Z","title":"Lvlm-ehub: A comprehensive evalu- ation benchmark for large vision-language models,","venue":null,"work_id":"c7fbe40f-ba63-4ffe-bc6e-2cc1a07b0daa","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.766983Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:7795db04bed33e91d9bdc3213b5a3de24c9eb08b7321d73798d37be1e40a41af","observation_id":"1a3f8058-e0bf-47b5-bba6-2050b962b7aa","resolution":{"observed_at":"2026-08-06T00:42:35.497375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.031576Z","title":"A survey of state of the art large vision language models: Benchmark evaluations and challenges,","venue":null,"work_id":"a15bd8ea-cde1-46f8-a355-83e7adbf5003","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.883500Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:bca46dcc39ec0fc8d66b7a7bd097cb037b301acd3e438e710baba299067afbc3","observation_id":"80177e8a-cfee-432f-a43c-0cc6e4de778a","resolution":{"observed_at":"2026-08-06T00:42:35.130269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:28.960540Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.960540Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:1e447bdb3f40c444f8c9d77540ba65edfb68853085de5d966862b10b960eef97","observation_id":"d852de2e-7fd3-4fff-8250-148d2e8d8edc","resolution":{"observed_at":"2026-08-06T00:42:28.960540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.843596Z","title":"Visual instruction tuning,","venue":null,"work_id":"6cae105a-ac55-4b63-8c07-95b2ab833a55","year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.069667Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:b5928dc61691a0387fd67586993e6ca7d41cc488761ab6556c599fc9c96f07a5","observation_id":"08f9f9e3-b82a-4755-b98d-3d9ddfa4c970","resolution":{"observed_at":"2026-08-06T00:42:34.913502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.596435Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":"9f1e574e-7051-4431-86db-6130e4f5c6b3","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.168884Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:59acfddfdd03a7e32aad9c3f8ce76ae7f515c6f05696d6481d1771efaa0efb2e","observation_id":"efda392e-900c-412b-9fdd-6bd72e86a1a9","resolution":{"observed_at":"2026-08-06T00:42:34.738232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.322858Z","title":"Llava-next: A strong zero- shot video understanding model,","venue":null,"work_id":"71917ca0-f6ff-4693-89ba-e23c2fb2bf6d","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.265624Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:23b53b985618bad718347a445dcbc6b50c2ff960f7a0ed446244aa04bdb92e74","observation_id":"d61176b1-410f-430c-9c6c-7cb4c513f253","resolution":{"observed_at":"2026-08-06T00:42:34.428770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T00:42:29.343041Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.343041Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:f9c6b00f4d22d89f2d044a61a748928543704fe36ac9aa8bddcbdf3c47dd1410","observation_id":"f96fe334-1915-4f38-98d8-dbfb38687328","resolution":{"observed_at":"2026-08-06T00:42:29.343041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T00:42:29.392607Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.392607Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:eaa8cc99abd29ca166009b3a1d4c6134b64139692d2d73fd9c2714528e81e379","observation_id":"83e09ee6-4ad6-406a-ac70-bf67506bbb05","resolution":{"observed_at":"2026-08-06T00:42:29.392607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T00:42:29.481695Z","title":"Qwen3-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.481695Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:be1217e8198d00eb596a21a108b3b31a1bee7501d09faca7a0cfeb5f11b85941","observation_id":"72117b07-a724-4c12-9674-f85027c352b1","resolution":{"observed_at":"2026-08-06T00:42:29.481695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.222582Z","title":"Neurosurgeon: Collaborative intelligence between the cloud and mobile edge,","venue":null,"work_id":"45a2e5d8-9aa9-489f-bfbd-7946293b8a5e","year":2017},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.613466Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:5041b3dd85cf3e90ed7f10a0d65e388919550919cd3311a6d695859f0be2ead7","observation_id":"34f7ed36-1561-4f5d-b985-142bdbd60095","resolution":{"observed_at":"2026-08-06T00:42:34.298730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10759","last_updated":"2024-10-16T16:31:37Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:38:41Z","title":"SplitLLM: Collaborative Inference of LLMs for Model Placement and Throughput Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10759","snapshot_observed_at":"2026-08-06T00:42:29.718307Z","title":"Splitllm: Collaborative infer- ence of llms for model placement and throughput optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.718307Z"},"links":{"cited_paper":"/paper/2410.10759","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:c217d3e5581037fe27ceb05f6be483a9a2e77164024a17853810dac539c2d9bb","observation_id":"81076eba-15a5-423d-8b3b-8578df105b91","resolution":{"observed_at":"2026-08-06T00:42:29.718307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.074037Z","title":"Model-distributed inference for large language models at the edge,","venue":null,"work_id":"95fe512c-085a-4c3d-ab46-2220e4bb1b2b","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.816891Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:b7174df17eb98a6982371603e0f527175a1cc78c71eb907bea047f2d59746728","observation_id":"264f84ab-b502-4368-af15-4e76d698dbef","resolution":{"observed_at":"2026-08-06T00:42:34.154313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.945344Z","title":"Petals: Collaborative inference and fine-tuning of large models,","venue":null,"work_id":"328895fc-265c-45ac-a050-ef5a5e76480b","year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.924310Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:76acfb4a88de6bbe735b747ef9439bc64a1d78588814bae5b7f4736bc54c6b51","observation_id":"14a26aed-54c7-4df0-b0df-ff009e8dce7d","resolution":{"observed_at":"2026-08-06T00:42:34.005500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.798857Z","title":"Understanding deep image represen- tations by inverting them,","venue":null,"work_id":"a6080884-b4a2-4d57-9643-8e691a06f091","year":2015},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.977794Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:0abfa7a65708c41adb30a035523a060ae77420c0fd7a908a51d8b67d129dcd39","observation_id":"e051eccf-6d97-4355-9dea-60e8d4638375","resolution":{"observed_at":"2026-08-06T00:42:33.849026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.677355Z","title":"The secret revealer: Generative model- inversion attacks against deep neural networks,","venue":null,"work_id":"d681b85f-4702-433f-b236-1e84a8724178","year":2020},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.041570Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:ec899005d7123dd315df3e0792ddc3f6de4e41085a44df1a251c8858bf001c18","observation_id":"f17ad10a-5f44-445b-83b9-206937aab9e8","resolution":{"observed_at":"2026-08-06T00:42:33.737298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.529290Z","title":"FaceObfuscator: Defending deep learning-based privacy attacks with gradient descent-resistant features in face recognition,","venue":null,"work_id":"fd5b9cf7-e3c6-4b08-a559-141831382557","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.122982Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:f7fba2a01a7f08f29cc0535464478e0a1ca4cc1cae2326aa161a7986d9be9ca6","observation_id":"4f8f7999-204e-4d7b-bb6d-d593d76a2b0d","resolution":{"observed_at":"2026-08-06T00:42:33.593905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.338840Z","title":"Gradvit: Gradient inversion of vision transformers,","venue":null,"work_id":"f0161397-1e24-4c28-bb87-0ca3f8abe521","year":2022},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.203069Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:cfc043c860bbfa5aaa7d8d59b94a8b011d95cf5339e2646678df68b7c2ad74fb","observation_id":"ea2cbac1-d24d-4940-a0b9-b488dd64b767","resolution":{"observed_at":"2026-08-06T00:42:33.398543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02580","last_updated":"2024-03-05T01:32:29Z","snapshot_observed_at":"2026-07-06T17:39:37.064843Z","submitted_at":"2024-03-05T01:32:29Z","title":"What do we learn from inverting CLIP models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02580","snapshot_observed_at":"2026-08-06T00:42:30.330083Z","title":"What do we learn from inverting clip models?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.330083Z"},"links":{"cited_paper":"/paper/2403.02580","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:70dcaed38bdf0d188fbbf190c6cb74abbd5ef898b6c8f9530cb3203cf74851ed","observation_id":"20ecf680-2b33-4ed6-9ba5-58b2065abaf7","resolution":{"observed_at":"2026-08-06T00:42:30.330083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.182280Z","title":"Information leakage in embedding models,","venue":null,"work_id":"115df285-89e5-4053-a710-50f583e6e98e","year":2020},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.380183Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:d2a83084a8c8b5e223ab6e522232e3af2a96aa491fe5db4c32fc353b25489bdc","observation_id":"3eb97dac-c959-47a5-8b05-88248754acc9","resolution":{"observed_at":"2026-08-06T00:42:33.292469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.025571Z","title":"Privacy risks of general-purpose language models,","venue":null,"work_id":"e4be4ad1-65aa-4edc-b329-68d36fc1ef98","year":2020},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.439543Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:313610227fbf5cd561e572832c87c48130ace4b990a3440df4a7788aa1ec46f1","observation_id":"0ec4ea90-b060-4dbd-8085-093a9ad4b3da","resolution":{"observed_at":"2026-08-06T00:42:33.100376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.852271Z","title":"Extracting prompts by inverting llm outputs,","venue":null,"work_id":"ee8ab25e-e402-42cd-80ab-40174b342417","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.499767Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:b98ec93a8848e5a2c5c2ca07dd17ab2e047cd32de5f7ba4a7e14d790243d9f2b","observation_id":"291d7993-2487-4aa9-a383-677cda72c9ea","resolution":{"observed_at":"2026-08-06T00:42:32.915084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.657504Z","title":"Text embeddings reveal (almost) as much as text,","venue":null,"work_id":"6f63d783-9400-44a3-a72a-0aece1b01894","year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.556939Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:29ea4e0f6c8c518cfd7ff4f9ca0bcd831c89b0992220aaf082517e5d1df8774f","observation_id":"89fd303f-6e19-4ca6-a77b-323749c9b2a1","resolution":{"observed_at":"2026-08-06T00:42:32.752216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.483513Z","title":"Prompt inversion attack against collab- orative inference of large language models,","venue":null,"work_id":"a1168828-2494-4b88-aa94-e8415bf4e376","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.635937Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:6ad5e502f5af907dc2f035fb124d952594d5a9b962513e8496165f72f25a7a31","observation_id":"f6c9f2aa-49af-4689-81c4-9b4c8be29a52","resolution":{"observed_at":"2026-08-06T00:42:32.559352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.369990Z","title":"Caprecover: A cross-modality feature inversion attack framework on vision language models,","venue":null,"work_id":"cedddc47-9591-4abb-8f1f-92f78bd54f33","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.690712Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:ee7939cc598332757cfa0fec3f24c8099ef3a8f0ef42bfd3f7b2415b71892522","observation_id":"e045d0aa-a0cc-4a1e-b911-e970037bd5e1","resolution":{"observed_at":"2026-08-06T00:42:32.428153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.232750Z","title":"Do vision-language models leak what they learn? adaptive token-weighted model inversion attacks,","venue":null,"work_id":"aa273965-171a-456d-bb96-2fd24c9a0ab5","year":null},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.750157Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:274b4d32790f70ae0ecf96085fa6882c1012190d63f8a9a07e479437e755077f","observation_id":"95269d61-675c-4250-99d6-00b83a49a574","resolution":{"observed_at":"2026-08-06T00:42:32.306493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.091364Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering,","venue":null,"work_id":"30ee1a04-77ac-44b6-b2dc-d84f19d1b582","year":2017},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.907925Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:14adced2ce5f9b0ec85742a6ef5faa816a63f1f58a230e6764cb822c4eee8180","observation_id":"169469fb-ad97-4231-bd1b-02763d6a8e33","resolution":{"observed_at":"2026-08-06T00:42:32.160213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.954830Z","title":"Deep learning face attributes in the wild,","venue":null,"work_id":"f530381a-e7f3-4084-bb31-ed667b2f4af6","year":2015},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.966920Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:f352b32643375436b357438dd28a68a05c476ecfabfe726bbd7fca5541734e2b","observation_id":"bd800934-0492-401a-ae36-8c78b7a56164","resolution":{"observed_at":"2026-08-06T00:42:32.001261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.024444Z","title":"Automated flower classification over a large number of classes,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.024444Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:ecb8a6353fff94d075801c9fb6374452461a690f3e27118930e7933534e279fc","observation_id":"9081f5d2-4e96-4632-a8bf-25b63ef091da","resolution":{"observed_at":"2026-08-06T00:42:31.024444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05355","last_updated":"2018-12-18T10:58:20Z","snapshot_observed_at":"2026-07-06T06:28:16.475418Z","submitted_at":"2018-03-14T15:30:37Z","title":"FEVER: a large-scale dataset for Fact Extraction and VERification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05355","snapshot_observed_at":"2026-08-06T00:42:31.081302Z","title":"Fever: a large- scale dataset for fact extraction and verification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.081302Z"},"links":{"cited_paper":"/paper/1803.05355","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:92cebdf9e2f23ed620a2206f7c3995ac453a14bde12bbb9ee8993fc9b8225a94","observation_id":"621d91d1-d45a-44cb-bec8-c858179f1986","resolution":{"observed_at":"2026-08-06T00:42:31.081302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.838693Z","title":"Ms marco: A human- generated machine reading comprehension dataset,","venue":null,"work_id":"e33a2717-bdb3-44fc-bcc7-5965b70c940a","year":2016},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.126981Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:6ec1fab0fb2e1755bee9e2221ba435eb44d75fe9614362232fe277c2b2064bb9","observation_id":"3a3a0d31-2469-4134-b019-4dcc80db34ee","resolution":{"observed_at":"2026-08-06T00:42:31.903031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.738443Z","title":"Anycost gans for interactive image synthesis and editing,","venue":null,"work_id":"c8646915-33aa-4085-badc-5d0fce8c0d67","year":2021},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.204167Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:5c943911baa5e7cbde47d5b2c80132dfcfb79ff83edbfba79cdab54130edeadc","observation_id":"a2dfb1fd-8599-4409-90cf-c470c465470f","resolution":{"observed_at":"2026-08-06T00:42:31.776581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.04097","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.374340Z","title":"Available: https://arxiv.org/abs/2508.04097","venue":null,"work_id":"ac844d52-e79e-4f8a-8f0c-ead565cc2b92","year":null},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.829012Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:1c478da44ca5045f36266bc49f65f5cc048161285e485dd141cc104adda46dbe","observation_id":"affabe7d-c9bf-431e-8f79-51d24993ea9f","resolution":{"observed_at":"2026-08-06T00:42:31.426712Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T03:39:39.632625Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":27},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01020."}