{"as_of":"2026-08-11T05:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6a0b251696473b9bded50bb46708bdc08f4a70a6a5ca6767950764d042f2c196","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:59:36.659081Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T19:06:08.951475Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T19:08:54.358384Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"cited_work":{"arxiv_id":"2501.13985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13985","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2501.13985 , year=","venue":null,"work_id":"b91512c9-5b2c-4b89-a969-4bb6d5df78ae","year":null},"citing_paper":{"arxiv_id":"2605.16690","last_updated":"2026-05-15T23:06:59Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:06:59Z","title":"UB-SMoE: Universally Balanced Sparse Mixture-of-Experts for Resource-adaptive Federated Fine-tuning of Foundation Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-20T19:06:08.951475Z"},"links":{"cited_paper":"/paper/2501.13985","citing_paper":"/paper/2605.16690"},"observation_digest":"sha256:18e691322e01d25062c99438be7e11f795405cfc85f21ede77d82901df617c51","observation_id":"a3271561-71fa-490d-9e06-bc31441ac24c","resolution":{"observed_at":"2026-05-20T19:08:54.359877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.13985/citation-record","integrity":"/paper/2501.13985/integrity","json":"/paper/2501.13985/citation-record.json","paper":"/paper/2501.13985"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.443077Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.443077Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:c01ae982110eb39ea378f22aca63fcbbe00c6ea2b01cfae056e99dfdeca9a31e","observation_id":"67ee9aca-9eed-41fd-b406-66ba6a16ae3b","resolution":{"observed_at":"2026-08-10T15:59:36.443077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.447726Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.447726Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:4cff3904b6856e134110b86923c63d6c178771f138c5d2184fde3456c029ad79","observation_id":"819fa708-c6e1-4c10-8e71-e0855d760866","resolution":{"observed_at":"2026-08-10T15:59:36.447726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.247400Z","title":"A.; Noorbakhsh, S","venue":null,"work_id":"adac1837-7233-4e6c-a9e0-ce9634c01a77","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.453932Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:8f1e67a249e6dde807c327a126fb41ead7f7c48b819d69bcf4ffb7ca30515974","observation_id":"f7917404-bcbf-45d2-a91e-074a9fb45da1","resolution":{"observed_at":"2026-08-10T15:59:37.251731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.236266Z","title":null,"venue":null,"work_id":"d052f969-e12b-4dc6-b362-ce20721faf3d","year":2016},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.458693Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:5d28ddebf616933423edd5d7f6e5c16f42cc3fb882bea82a452542ea6d1d1816","observation_id":"c6f89f99-84b6-403a-850e-9df4686ee972","resolution":{"observed_at":"2026-08-10T15:59:37.239903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.225076Z","title":null,"venue":null,"work_id":"a3e6d71e-c8b8-45e7-aa32-9564fffe047a","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.463399Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:3d878152c4b7cc8600c08eb1bac9ec90ec54d827225bc7feb47f6a869c70e4c2","observation_id":"e4ef43dc-abba-4aaa-8b3e-784064139bfb","resolution":{"observed_at":"2026-08-10T15:59:37.228822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.213944Z","title":null,"venue":null,"work_id":"d6d0050f-8ebd-40d1-ab52-742bbbb9e2a3","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.467763Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:6e85bb0950579b7b8fa3e792ad0a483b6881ab5bf12e449f542005dfb590e264","observation_id":"a7ea6803-f8d6-4262-bccf-4f0273f46e77","resolution":{"observed_at":"2026-08-10T15:59:37.218001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.202418Z","title":null,"venue":null,"work_id":"f0b87868-cf70-40ed-8e2d-f678593b769b","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.471781Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:a3184fa8e2ae6971d0cebd12fc816a754cb335e4e524303c466ce0338f96f13d","observation_id":"3991a907-6cdf-472f-b7f5-6cc50381cb7e","resolution":{"observed_at":"2026-08-10T15:59:37.206345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-10T15:59:36.475912Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.475912Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:d936088989c3ce848800ee954fa64641838102712c86587e1f41ea4852747636","observation_id":"b8d75ea9-0514-49d8-9c93-ecfb75870b1b","resolution":{"observed_at":"2026-08-10T15:59:36.475912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.480441Z","title":"E.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.480441Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:b2242cd79cc8b4821dded3f1df47822d6af6d07d9f95e15e02486c278fe99eb3","observation_id":"24ada076-4659-4f94-9242-7dd4a2cc33f3","resolution":{"observed_at":"2026-08-10T15:59:36.480441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-10T15:59:36.484956Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.484956Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:333dec126b869cecbd23d226f557fb89889c5c53ba09c132506ef3b4c249f916","observation_id":"d115e5af-186d-4da0-ba32-6fcda9dbe16b","resolution":{"observed_at":"2026-08-10T15:59:36.484956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.489477Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.489477Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:0fb5bed9059c5a53849de33199eb69de31592bb7a731875ecde69a7e19a062b8","observation_id":"028b11cc-e42e-4212-8379-b7b050fdfa08","resolution":{"observed_at":"2026-08-10T15:59:36.489477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-08T22:04:13.117781Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-10T15:59:36.493468Z","title":"S.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.493468Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:f505626dd89fb2e3fcf6d61b2b62d85724c4ea0a149fe7e462746631a3c768eb","observation_id":"2e713aa0-9afd-47c3-9a81-73816e115f72","resolution":{"observed_at":"2026-08-10T15:59:36.493468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.07948","last_updated":"2020-10-23T03:04:01Z","snapshot_observed_at":"2026-08-08T19:27:05.920106Z","submitted_at":"2020-02-19T01:08:46Z","title":"Personalized Federated Learning: A Meta-Learning Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.07948","snapshot_observed_at":"2026-08-10T15:59:36.498912Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.498912Z"},"links":{"cited_paper":"/paper/2002.07948","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:50cad8de9a10ab79454d1ed4f8b27f4660e1d5fe923af5d89d4e31d63a4eb53a","observation_id":"a37fd9b8-aa32-4029-8943-30972ab52593","resolution":{"observed_at":"2026-08-10T15:59:36.498912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10049","last_updated":"2023-10-16T04:17:13Z","snapshot_observed_at":"2026-08-08T09:36:17.477554Z","submitted_at":"2023-10-16T04:17:13Z","title":"FATE-LLM: A Industrial Grade Federated Learning Framework for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10049","snapshot_observed_at":"2026-08-10T15:59:36.503124Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.503124Z"},"links":{"cited_paper":"/paper/2310.10049","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:44799beb212682928c3e2e7803879dbd140c265e2d1f5cd5d9b1ab7c5c7412c1","observation_id":"784ed9c4-7516-41ab-8e0c-13d275b71b7b","resolution":{"observed_at":"2026-08-10T15:59:36.503124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.507309Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.507309Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:54a28e83f29644e3f2183b36246dd4b60622c43719d7c242207d15dc32b90ff2","observation_id":"2f98b88e-a334-4b08-bb7d-76b63a33b23f","resolution":{"observed_at":"2026-08-10T15:59:36.507309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.168162Z","title":null,"venue":null,"work_id":"98a6396d-ce7a-44f2-87d7-943b723e3d08","year":2021},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.510966Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:a9ae01b34afab90070077b3edd66503c3b32efdc804228dee01164cbfaa626e5","observation_id":"6f43b329-140f-45af-a772-368af4f3f6c3","resolution":{"observed_at":"2026-08-10T15:59:37.172636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.156124Z","title":null,"venue":null,"work_id":"5256520d-843f-4da1-a2bb-2fe94ac0fc6e","year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.515744Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:5648dfdf5b1ab34735e6ff362d04905b65df28a0db6794edb2c362e286be657c","observation_id":"10d312ae-526d-4436-8d8f-8d3055ac3d7b","resolution":{"observed_at":"2026-08-10T15:59:37.160104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16206","last_updated":"2023-11-27T15:04:48Z","snapshot_observed_at":"2026-08-10T23:53:01.783368Z","submitted_at":"2023-11-27T15:04:48Z","title":"Continual Instruction Tuning for Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16206","snapshot_observed_at":"2026-08-10T15:59:36.520464Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.520464Z"},"links":{"cited_paper":"/paper/2311.16206","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:f60cac32b98b2a78a24a876e326e4cfe4ca2915477986b715cb8a2be33259793","observation_id":"634055bf-e472-4221-afdf-a3fcbb4cb7e7","resolution":{"observed_at":"2026-08-10T15:59:36.520464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-10T15:59:36.524719Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.524719Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:9e52d978ebf9264824169e32222c9776946403ee2c80f632a03c9538f4bddbfe","observation_id":"b04f8c8c-aadf-4286-ac56-4149931ba79c","resolution":{"observed_at":"2026-08-10T15:59:36.524719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.142619Z","title":null,"venue":null,"work_id":"027a210f-b318-4ab0-862b-32101b5d9a54","year":2019},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.528286Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:94476895cd574aedc5a94eb0dd85965b241c0d52d6d70ae69c4ab271b2c16d15","observation_id":"024eb770-e9e8-4c3d-a838-dd16348ddbce","resolution":{"observed_at":"2026-08-10T15:59:37.146551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.129705Z","title":null,"venue":null,"work_id":"5190ee75-c0b6-4c07-a3b7-152ecac236a0","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.532280Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:1a59136e09706bff91750ef9bbe88d035a9e69ac248190776c03faaa8d99bcc3","observation_id":"0900d2e5-4b8d-496f-879f-d09593f6bca3","resolution":{"observed_at":"2026-08-10T15:59:37.134156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.118078Z","title":null,"venue":null,"work_id":"36238319-362c-42bd-a52a-221724d4b547","year":2014},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.536254Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:765b1f3b6d9fc0175b550a286937b42a8a3f38d38ffd309c100e31423da6a240","observation_id":"6128c6a7-66fa-4b31-89db-5e3f964d0811","resolution":{"observed_at":"2026-08-10T15:59:37.121954Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.540869Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.540869Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:c9d13a73c248f87353c9bfb296a4d603848f028d56a1475745230739c884d397","observation_id":"ddb0a05d-3987-4081-b922-a6e4e975171f","resolution":{"observed_at":"2026-08-10T15:59:36.540869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.545106Z","title":"K.; Zaheer, M.; Sanjabi, M.; Talwalkar, A.; and Smith, V","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.545106Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:9c84a72fbfff16ad005b79ef8bd14a9544a3f07e8c46ce3612281ee4cb9dcac2","observation_id":"2bceea5d-bde6-4191-ad8e-eb56cf938a5c","resolution":{"observed_at":"2026-08-10T15:59:36.545106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.549663Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.549663Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:a292bbab772ea9f2d7d0dd64adf5a7ce4d7e34c9c46de369eb44ba4597aebebd","observation_id":"0fa18a63-55ab-47c1-ae9f-7857c170af85","resolution":{"observed_at":"2026-08-10T15:59:36.549663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.553401Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.553401Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:e89748671a38b1036e1799ae5739c7f12b559d6515193cc51886b4019f9407f4","observation_id":"877a262a-c816-40f0-8533-a7aee2bc23a2","resolution":{"observed_at":"2026-08-10T15:59:36.553401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.557112Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.557112Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:10947c6d8e8d5a2e1fd010d33c4a25b882760f5933e7bcb14c673fd5f5e5426e","observation_id":"eebd9a2a-21da-4fc2-9a21-7613469be1bd","resolution":{"observed_at":"2026-08-10T15:59:36.557112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13485","last_updated":"2023-07-09T12:36:50Z","snapshot_observed_at":"2026-08-10T17:35:38.582306Z","submitted_at":"2023-02-27T02:49:06Z","title":"FedCLIP: Fast Generalization and Personalization for CLIP in Federated Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13485","snapshot_observed_at":"2026-08-10T15:59:36.560652Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.560652Z"},"links":{"cited_paper":"/paper/2302.13485","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:b7e8b55f67c8c6aa91a58f47fe18934a06a08fcc6374191aa0724f30f079c5a9","observation_id":"0dd83d4e-f28c-4769-9191-8c4292953696","resolution":{"observed_at":"2026-08-10T15:59:36.560652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.564262Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.564262Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:19654c1762d94256d33d2aaa77f188f7b95b04a5ee8dd5cf6d486cd59674844c","observation_id":"0f6b3f37-bac7-4916-829a-c603117b02fd","resolution":{"observed_at":"2026-08-10T15:59:36.564262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.065045Z","title":"K.; and Chakraborty, A","venue":null,"work_id":"72f1ebe8-4223-4eb3-8625-906c34079aa5","year":2019},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.567970Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:e5979106ec91405f9f6628f1e893ac8f63a394512d92654626d1f18d921a329d","observation_id":"92f8aea3-0282-48a7-8c2a-66551332a8ff","resolution":{"observed_at":"2026-08-10T15:59:37.068673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.572250Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.572250Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:e3cb82ec531501d1f969008a4cee18cbf9a1838f5ce1aed8f3f329a3ef19b60f","observation_id":"4e347b8e-97dc-413e-b692-940e93bb9c17","resolution":{"observed_at":"2026-08-10T15:59:36.572250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.00295","last_updated":"2021-09-08T23:37:17Z","snapshot_observed_at":"2026-07-06T09:01:12.515300Z","submitted_at":"2020-02-29T16:37:29Z","title":"Adaptive Federated Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.00295","snapshot_observed_at":"2026-08-10T15:59:36.576179Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.576179Z"},"links":{"cited_paper":"/paper/2003.00295","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:9d71ad2399a08cc3b99c64569424aa2502a9d28240593a652bc748ec6063d3dc","observation_id":"dbd5348f-b777-45e2-adc6-5f4dd46e8112","resolution":{"observed_at":"2026-08-10T15:59:36.576179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15896","last_updated":"2024-12-06T00:41:15Z","snapshot_observed_at":"2026-08-10T07:04:01.076978Z","submitted_at":"2024-02-24T20:15:31Z","title":"Multimodal Instruction Tuning with Conditional Mixture of LoRA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15896","snapshot_observed_at":"2026-08-10T15:59:36.580483Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.580483Z"},"links":{"cited_paper":"/paper/2402.15896","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:8b26c3aacba341551ecc93c40a0ada7339762b9d298da63a5413be05c0bb91d4","observation_id":"2dd468db-4df8-42ae-bd33-9ab33414c4f3","resolution":{"observed_at":"2026-08-10T15:59:36.580483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08648","last_updated":"2023-12-14T04:07:49Z","snapshot_observed_at":"2026-08-10T06:51:16.061419Z","submitted_at":"2023-12-14T04:07:49Z","title":"CLIP-guided Federated Learning on Heterogeneous and Long-Tailed Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08648","snapshot_observed_at":"2026-08-10T15:59:36.585117Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.585117Z"},"links":{"cited_paper":"/paper/2312.08648","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:12a09dbb2d53a154d7ac24647bcb8bdfccc710ed7216348d556ee1364e691984","observation_id":"4ec1e640-46d1-4853-b95f-f0f22bfd5bb4","resolution":{"observed_at":"2026-08-10T15:59:36.585117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.046556Z","title":null,"venue":null,"work_id":"d36d8203-421c-417f-85bb-1dfd9992827e","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.589860Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:822bebb1648900c24c0dbd0ff2acf4c2f07f66a1dc038da893395e500067b6df","observation_id":"47e0f7b8-5a54-4864-8c65-cdfb8ea213b5","resolution":{"observed_at":"2026-08-10T15:59:37.050654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.035701Z","title":null,"venue":null,"work_id":"7191f864-4a07-4575-9a14-3f73b2ecfc9b","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.593615Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:f7c55bab5fa923c5ee3e0115232ed21e34fa9c50e9a945318df373671e2254ee","observation_id":"a99e7176-fd3b-4517-a4cf-c7af0b83b76d","resolution":{"observed_at":"2026-08-10T15:59:37.039181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-10T07:52:08.606999Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-10T15:59:36.598003Z","title":"Y.; Guu, K.; Yu, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.598003Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:a2805c3eb21b8b276c2782a8c2421a8f5c2fc8a472c304fc3367de2848e46e98","observation_id":"cad62666-3f80-4d1f-9182-3d743042bacb","resolution":{"observed_at":"2026-08-10T15:59:36.598003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.025113Z","title":null,"venue":null,"work_id":"466ab1b1-36ce-49a4-9034-4f60ba6bcafb","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.602787Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:43acec478ae5337eb749e2954bf69acd85aed48e640b9bb50896dc7cf1e26dcd","observation_id":"ad03d722-3a92-42cb-851c-f5006f623749","resolution":{"observed_at":"2026-08-10T15:59:37.028884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08021","last_updated":"2024-10-25T16:25:26Z","snapshot_observed_at":"2026-08-06T16:06:24.686113Z","submitted_at":"2024-10-10T15:18:19Z","title":"OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08021","snapshot_observed_at":"2026-08-10T15:59:36.606904Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.606904Z"},"links":{"cited_paper":"/paper/2410.08021","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:9d5c0eaa821d14cebd2de95658bebda3d9fe447b3f61941e911d14824768df1b","observation_id":"2fd489a4-04dd-4e17-b12d-03f3c36202bc","resolution":{"observed_at":"2026-08-10T15:59:36.606904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.611508Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.611508Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:cfa7e6d14f96fd414aff892b8bad3a55cf057d27e9da740ee261dc5a32bcc89a","observation_id":"fa477a90-2a4a-4fa5-aadd-72775ac63e18","resolution":{"observed_at":"2026-08-10T15:59:36.611508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:37.005042Z","title":null,"venue":null,"work_id":"674aed39-3f7e-4892-84f6-df88bc7e801e","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.615421Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:f59998e9c0a454e18a5517b515c4e17971434ea488a153acf737e927a8e36855","observation_id":"a69ef708-a340-403f-889a-536c0ce47df8","resolution":{"observed_at":"2026-08-10T15:59:37.008984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10140","last_updated":"2024-05-16T14:34:44Z","snapshot_observed_at":"2026-07-06T18:15:20.397376Z","submitted_at":"2024-05-16T14:34:44Z","title":"Libra: Building Decoupled Vision System on Large Language Models","version":1},"cited_work":{"arxiv_id":"2405.10140","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.10140","snapshot_observed_at":"2026-08-10T15:59:36.769521Z","title":"Libra: Building Decoupled Vision System on Large Language Models","venue":"cs.CV","work_id":"f2be2c34-151f-4f9d-a465-ecc99eec06d9","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.619579Z"},"links":{"cited_paper":"/paper/2405.10140","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:39b323ee423dbac790bb7d735b187b7c63b790d7e6b8f0465d05f553d74a7d2d","observation_id":"8b963eeb-251b-4b6f-a493-078d9e3382d3","resolution":{"observed_at":"2026-08-10T15:59:36.776833Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-08-10T15:59:36.624222Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.624222Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:b762a9d549ba6f717fefda7ea16093f08c320a02b6148a2079fec987793058d1","observation_id":"58dbb0be-89eb-4e72-83e6-589bbd78fcd4","resolution":{"observed_at":"2026-08-10T15:59:36.624222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.990429Z","title":null,"venue":null,"work_id":"6fe6f3f6-eae1-46ab-8b66-b651f1392a77","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.628306Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:e2e4dbcf2976e9156f798c8888f7967dbacc118b89e0c732893a4d6284b0ede5","observation_id":"fe2a9ed8-0655-4cc9-8787-63afa78763bc","resolution":{"observed_at":"2026-08-10T15:59:36.994121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.977854Z","title":null,"venue":null,"work_id":"a8ebaf7e-5451-45a1-8e74-49b6fac0d1b4","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.631843Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:f9e3e4b92a3361e583b94902bf37b0346c6318200cb496a1862dc942b8deab13","observation_id":"f5622e23-2b27-44e5-b601-bfc07a10eb46","resolution":{"observed_at":"2026-08-10T15:59:36.981680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19211","last_updated":"2024-12-02T10:44:08Z","snapshot_observed_at":"2026-08-10T12:45:40.745185Z","submitted_at":"2024-03-28T08:19:33Z","title":"Dual-Personalizing Adapter for Federated Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19211","snapshot_observed_at":"2026-08-10T15:59:36.635342Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.635342Z"},"links":{"cited_paper":"/paper/2403.19211","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:b64926622b3fa16e4e172f86da7cf300aeda51ab440b5f7ee78ae6c2cc07f18f","observation_id":"8e5d379a-8311-4bd1-90be-d5670be39b46","resolution":{"observed_at":"2026-08-10T15:59:36.635342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-10T15:59:36.638898Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.638898Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:ddcfb4c3a135a2671c5c3b59b617c910a92275d70bb29b6e71bb2ea6ed15c4a7","observation_id":"1ccb07d3-e20f-4f95-98fb-d00b5d0ea4f4","resolution":{"observed_at":"2026-08-10T15:59:36.638898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06954","last_updated":"2024-02-10T13:50:11Z","snapshot_observed_at":"2026-08-10T05:16:36.727805Z","submitted_at":"2024-02-10T13:50:11Z","title":"OpenFedLLM: Training Large Language Models on Decentralized Private Data via Federated Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06954","snapshot_observed_at":"2026-08-10T15:59:36.642594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.642594Z"},"links":{"cited_paper":"/paper/2402.06954","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:4285ba54076c4a489072d13e75a909a1cbd71f1feed591edb1008b4dea7bdbcb","observation_id":"5097e38d-e042-47b4-8e45-6818a4b1b342","resolution":{"observed_at":"2026-08-10T15:59:36.642594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.966739Z","title":null,"venue":null,"work_id":"8b8d64cd-2274-4c2b-a163-d0e80121aa13","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.647088Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:9704d0aaccfe04fb0ddb422c1644e4385c193d5342a554c69aa6a5378b6d9eaf","observation_id":"30d85429-b9b5-4fbb-b261-48550b2de59d","resolution":{"observed_at":"2026-08-10T15:59:36.970494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:59:36.954476Z","title":null,"venue":null,"work_id":"73594599-362d-43cc-99ca-90ee027162ad","year":2024},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.650661Z"},"links":{"citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:df2cd308c7044f3241b0b335908294bddeb253b6d57d0513c790f01d7f7c27b6","observation_id":"db5a4053-9e9d-4849-b46f-059e6f451cce","resolution":{"observed_at":"2026-08-10T15:59:36.958242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-10T15:59:36.654753Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.654753Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:f16dad99d39b43cbd43b7b84c4c620967d0d425639d19929dc4c9c6822481159","observation_id":"9ee000ae-81c3-4a43-ac5b-f33704d8853b","resolution":{"observed_at":"2026-08-10T15:59:36.654753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08906","last_updated":"2022-04-29T23:24:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-17T21:39:10Z","title":"ST-MoE: Designing Stable and Transferable Sparse Expert Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08906","snapshot_observed_at":"2026-08-10T15:59:36.659081Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T15:59:36.659081Z"},"links":{"cited_paper":"/paper/2202.08906","citing_paper":"/paper/2501.13985"},"observation_digest":"sha256:4627648a64006269a1a89a5d8a243cdb949a1f008d0a9c5d19c0a6d917c71834","observation_id":"325f11c7-1447-4e03-9521-67445b839b24","resolution":{"observed_at":"2026-08-10T15:59:36.659081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.13985","last_updated":"2025-01-23T07:49:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T17:35:55.946804Z","submitted_at":"2025-01-23T07:49:24Z","title":"Pilot: Building the Federated Multimodal Instruction Tuning Framework"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2501.13985."}