{"as_of":"2026-08-08T17:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e5d2eddfb156835fbf5f8d56cb1073290f986cf1375527c1ec8be6c62a9c0a7f","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:59:03.752559Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03433/citation-record","integrity":"/paper/2509.03433/integrity","json":"/paper/2509.03433/citation-record.json","paper":"/paper/2509.03433"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.455468Z","title":"Gait adaptation to visual kinematic perturbations using a real-time closed-loop brain–computer interface to a virtual reality avatar,","venue":null,"work_id":"b8bfd0e1-f4d7-49d5-be74-167c35128c4a","year":2016},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.546707Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:92f0d225fad5d383f4899089696696ebe914ceb32a13608b671b0ebaeed8c3d0","observation_id":"369f365e-641d-45f2-bb1f-0927b628b3f3","resolution":{"observed_at":"2026-08-05T10:59:04.459826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.442949Z","title":"An online ssvep-bci system in an optical see-through augmented reality environment,","venue":null,"work_id":"9b16a115-c759-4442-9940-0d4f993cd3b9","year":2020},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.551846Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:16b2f36a46cbec249ace4302eca9f3bfac6c60ac567263af9b831609884fddc4","observation_id":"5b8eb8e6-aefb-48a7-9f69-b47f3f112ebc","resolution":{"observed_at":"2026-08-05T10:59:04.447223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.429913Z","title":"Repvgg: Mak- ing vgg-style convnets great again,","venue":null,"work_id":"eb151916-4487-4eac-8ffe-7f1f6dfde327","year":2021},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.556757Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:9f595b7e5bd99bc6a4609206bf158c556b68aaf81f5f9cbd4adaa37c428e8501","observation_id":"42f44969-1667-423c-9cb7-af3f4b183617","resolution":{"observed_at":"2026-08-05T10:59:04.434277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01888","last_updated":"2025-05-03T18:40:39Z","snapshot_observed_at":"2026-08-07T15:56:44.634934Z","submitted_at":"2025-05-03T18:40:39Z","title":"Rethinking Score Distilling Sampling for 3D Editing and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.01888","snapshot_observed_at":"2026-08-05T10:59:03.561083Z","title":"Rethinking score distilling sampling for 3d editing and generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.561083Z"},"links":{"cited_paper":"/paper/2505.01888","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:2e6f4ce01ede1b9caeda1eb9c2474a749f1623af5d7d5d4f89523c4588a98626","observation_id":"4d568ae7-7430-40ea-95d1-efb6bce68490","resolution":{"observed_at":"2026-08-05T10:59:03.561083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11252","last_updated":"2024-05-18T10:41:57Z","snapshot_observed_at":"2026-07-06T18:16:07.706911Z","submitted_at":"2024-05-18T10:41:57Z","title":"Dreamer XL: Towards High-Resolution Text-to-3D Generation via Trajectory Score Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11252","snapshot_observed_at":"2026-08-05T10:59:03.566626Z","title":"Dreamer xl: Towards high-resolution text-to-3d generation via trajec- tory score matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.566626Z"},"links":{"cited_paper":"/paper/2405.11252","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:3bcdda6a4af50aa619dccd1e255bf6f54a494297d4309026aae1ca6c171a51f7","observation_id":"bd2eecbb-8df6-495f-881e-5198a0e1f214","resolution":{"observed_at":"2026-08-05T10:59:03.566626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.416504Z","title":"Decoding individual finger movements from one hand using human eeg signals,","venue":null,"work_id":"095cb70c-479d-44df-82eb-012e7eb731d0","year":2014},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.571524Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:f5849684413ac22b976ccf3d451732231e1f5bae030ef1f21e373d74e02adc34","observation_id":"097499f4-2391-4408-8172-9e159cc56c17","resolution":{"observed_at":"2026-08-05T10:59:04.420732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.403334Z","title":"Eeg-based bci control schemes for lower-limb assistive-robots,","venue":null,"work_id":"4ba01dc2-d231-4bf1-b4eb-5f57b8a9f4d8","year":2018},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.576138Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:0cf361c8ffc5f5dae9f656bc57caa9b4a305217e952b5854cdc5508f029c65b6","observation_id":"6556319b-e4a1-4718-ab73-7c615599735c","resolution":{"observed_at":"2026-08-05T10:59:04.407699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.390784Z","title":"Deep learning for elec- troencephalogram (eeg) classification tasks: a review,","venue":null,"work_id":"c7f57d0d-30c0-40e6-9f97-483ed01f5d27","year":2019},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.580145Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:9fc88dee3312907fadddb432fdc6233a7ac3ffcd8057f615e268c6c5f8ddddfa","observation_id":"33b7a45d-3f2d-49a5-9dc0-90d7d2d96f3b","resolution":{"observed_at":"2026-08-05T10:59:04.395059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.378735Z","title":"Real-time neuroimaging and cognitive monitoring using wearable dry eeg,","venue":null,"work_id":"4b529168-6e87-4d75-8753-aec904c3a17c","year":2015},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.584119Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:c3d4d986e176795ca64be65f890d18f1d6ef392b6828e24e8e3f72d4310cec5e","observation_id":"c47003a1-aa6e-4993-ae4b-4758fb8d0403","resolution":{"observed_at":"2026-08-05T10:59:04.382722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.366063Z","title":"Making sense of spatio-temporal preserving representations for eeg-based human intention recognition,","venue":null,"work_id":"f6439971-03be-499b-a277-16d5c9ef63d9","year":2019},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.588089Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:ac5e664a0ece3c75b57a3adc9c619025ab5b1105a7109c143e5f667465550307","observation_id":"2d9dee0f-a821-4bd1-927e-955dca854427","resolution":{"observed_at":"2026-08-05T10:59:04.370104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.352606Z","title":"Deep learning with convolutional neural networks for eeg de- coding and visualization,","venue":null,"work_id":"459629f4-8d84-45d1-b71c-0efcb581e7ee","year":2017},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.592198Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:a7f07530e981c3ec3325d32a104258ba07b307ed90e9069115aaa55c4a22d282","observation_id":"1f399ec3-c0c7-41e3-bf2b-11fae795d163","resolution":{"observed_at":"2026-08-05T10:59:04.357385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.340680Z","title":"Eeg conformer: Convolutional transformer for eeg decoding and visualization,","venue":null,"work_id":"1b7c972e-cecd-4df1-9fff-a2a2967d54fc","year":2022},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.595979Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:a23005bc65c1075358161a9f3bf8238fbe18559488ae62471169f6f9125a6f8c","observation_id":"09e39af0-6e46-4945-b171-932fdef05b11","resolution":{"observed_at":"2026-08-05T10:59:04.344563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13234","last_updated":"2024-04-04T10:08:10Z","snapshot_observed_at":"2026-08-08T11:57:49.716158Z","submitted_at":"2023-08-25T08:05:37Z","title":"Decoding Natural Images from EEG for Object Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13234","snapshot_observed_at":"2026-08-05T10:59:03.599839Z","title":"Decod- ing natural images from eeg for object recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.599839Z"},"links":{"cited_paper":"/paper/2308.13234","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:f45eec77a05fc50e1e1eadeb152e0497ffe21490f2fd48c8c3d1d8a8f67ecb42","observation_id":"19891721-0c95-4515-a6ae-38521f6b8e34","resolution":{"observed_at":"2026-08-05T10:59:03.599839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.328641Z","title":"Eeg-based emotion recognition with haptic vibration by a feature fu- sion method,","venue":null,"work_id":"5862148c-655b-46e2-81d9-1dab4c26077d","year":2022},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.604424Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:41b6808c645600146c0376f19b14c1ba659c47a10ab48564c25650093e1174e1","observation_id":"f43fedb5-4d5e-4f81-986e-2c1668a9793c","resolution":{"observed_at":"2026-08-05T10:59:04.332715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14030","last_updated":"2024-01-03T08:14:00Z","snapshot_observed_at":"2026-08-05T00:48:09.931353Z","submitted_at":"2023-09-25T10:52:28Z","title":"DeWave: Discrete EEG Waves Encoding for Brain Dynamics to Text Translation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14030","snapshot_observed_at":"2026-08-05T10:59:03.608879Z","title":"Dewave: Discrete eeg waves encoding for brain dynamics to text translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.608879Z"},"links":{"cited_paper":"/paper/2309.14030","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:dd0350f6d2303879b09c609b5f52817af5bfb1916df38d24f3b31e7e83b9bbe7","observation_id":"ec939fe3-3a2b-49b3-b96b-d7b14b9b640e","resolution":{"observed_at":"2026-08-05T10:59:03.608879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.315252Z","title":"Paivio, Imagery and verbal processes","venue":null,"work_id":"0b5057f6-ab39-44a7-a8f2-e01c15da8799","year":2013},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.613215Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:ecfc3c80cc9421064de41587d7c1df8957c30f40fb7daf5e920e315251b3695c","observation_id":"cf9c286e-984c-4660-8aeb-4cbbca0da183","resolution":{"observed_at":"2026-08-05T10:59:04.320105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.301836Z","title":"Dual coding of knowledge in the human brain,","venue":null,"work_id":"7c271e15-2798-4e1f-8a79-3a8811c6bc99","year":2021},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.617342Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:61cb7e7f83b5ba09661d3bc3ea33c59df1f952bfdd398f6a227e16baea91e6de","observation_id":"e39b81eb-273b-49bb-abcf-1f2a2955abd6","resolution":{"observed_at":"2026-08-05T10:59:04.306636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.288351Z","title":"Decoding visual neural representations by multimodal learning of brain-visual-linguistic features,","venue":null,"work_id":"52d5dccb-c6c3-4577-be7e-e86d1fcf3ac9","year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.621094Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:38fff7e347774b67926231aede03a9137abf50d284f06e8343e6799b037de899","observation_id":"ee7fc4d1-c723-485f-af4f-018cb49323c0","resolution":{"observed_at":"2026-08-05T10:59:04.293291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.275009Z","title":"What makes training multi-modal classification networks hard?","venue":null,"work_id":"ad630a7a-3142-4c74-b8d9-7bc0016ea812","year":2020},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.625378Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:effeadf6a3e21e3da3f65756edb4a78b60710cdd9e6bcfb055ad84b45379a81f","observation_id":"00a9f56d-0f90-4b45-91a7-7aa41177e8e6","resolution":{"observed_at":"2026-08-05T10:59:04.279782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.262858Z","title":"Balanced multi- modal learning via on-the-fly gradient modulation,","venue":null,"work_id":"c16b1792-e0ce-41f7-a4d7-4ff5d6b269f4","year":2022},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.629271Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:df7d9fddf68b67ad68b700dd8574dc032baaf99f1eb1631413728d903d61f21a","observation_id":"b0c47981-b98e-4a0b-a93c-434deb99bdd2","resolution":{"observed_at":"2026-08-05T10:59:04.266912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11059","last_updated":"2021-06-21T12:46:47Z","snapshot_observed_at":"2026-08-03T17:23:12.981213Z","submitted_at":"2021-06-21T12:46:47Z","title":"Improving Multi-Modal Learning with Uni-Modal Teachers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11059","snapshot_observed_at":"2026-08-05T10:59:03.633232Z","title":"Im- proving multi-modal learning with uni-modal teachers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.633232Z"},"links":{"cited_paper":"/paper/2106.11059","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:2e41a0f5436b5417e0b163f4929d586b0ced00d69d8215ac18a965ca94f91056","observation_id":"fb367fd5-136d-473c-b822-ec8fbd81c7f6","resolution":{"observed_at":"2026-08-05T10:59:03.633232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11273","last_updated":"2024-05-18T12:16:01Z","snapshot_observed_at":"2026-08-03T11:46:26.153374Z","submitted_at":"2024-05-18T12:16:01Z","title":"Uni-MoE: Scaling Unified Multimodal LLMs with Mixture of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11273","snapshot_observed_at":"2026-08-05T10:59:03.637569Z","title":"Uni-moe: Scaling unified multimodal llms with mixture of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.637569Z"},"links":{"cited_paper":"/paper/2405.11273","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:56bce148e5013d7746eed515c909e0418fd0b1fafef5c81622acdf1d7ac8d78b","observation_id":"618b561e-c9cf-4349-a1fe-7f7863b0b02e","resolution":{"observed_at":"2026-08-05T10:59:03.637569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.249412Z","title":"Dynamic unary convolution in transformers,","venue":null,"work_id":"940f9b26-eab6-4575-a09d-380bf220279a","year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.641651Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:3abbb60c1cdc7bf5d72b11baed21510b8fc03f98703312be31821bdd76cf4d39","observation_id":"62aec975-1291-4696-aec7-7962039a351a","resolution":{"observed_at":"2026-08-05T10:59:04.254128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.236124Z","title":"Pa- rameter efficient fine-tuning for multi-modal generative vision models with m¨ obius-inspired transformation,","venue":null,"work_id":"5f1037f1-4ebd-42a2-9452-268b0e7bf84e","year":2025},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.645484Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:9355d436c64d0d8d2d7a3fbf9d6dae6ac359f7733d1849a99d5652a366df336c","observation_id":"8e3a33bb-2eb5-495a-a2ed-200f94974084","resolution":{"observed_at":"2026-08-05T10:59:04.241041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.222938Z","title":"Ctnerf: Cross-time transformer for dynamic neural radiance field from monocular video,","venue":null,"work_id":"5fc76f9e-380c-46d3-a2e1-89e9153c52f1","year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.649420Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:fb8771df9aca81c1d05878f03bfdb9720303361ad1f81b548a7e33340693d32a","observation_id":"169f990a-6c8b-48f9-b321-6fcb6d2828e5","resolution":{"observed_at":"2026-08-05T10:59:04.227716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.209607Z","title":"The benefits of noise in neural sys- tems: bridging theory and experiment,","venue":null,"work_id":"873cc433-8ece-46c6-b21f-0d0648cf5a67","year":2011},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.653755Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:b7f571604d0aab1092c086c6a4db512837966992665c8c4069c984c8e782439b","observation_id":"1a63e25c-2f04-425b-923b-b9cc735960e2","resolution":{"observed_at":"2026-08-05T10:59:04.214099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.196057Z","title":"Improving unimodal object recognition with multimodal contrastive learning,","venue":null,"work_id":"d6c8fd78-e6ab-448c-bd97-40797eac36b3","year":2020},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.657984Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:55a93fedea2462769abe0c5fee5f57742e0db22d5d8bc12b773ca3f0a506d525","observation_id":"3ae7c01d-a859-4da7-8811-959569f050b0","resolution":{"observed_at":"2026-08-05T10:59:04.200918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.182044Z","title":"Ds-depth: Dynamic and static depth estimation via a fusion cost volume,","venue":null,"work_id":"c4766dac-c2e6-425d-afe1-e6f5cd28921a","year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.662596Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:c8f22fcdb7067f7ad254892d064359848625388c467cf6c469651d32c28fbd3c","observation_id":"c2d2b4ee-ad39-4537-b3f4-1608302bf1ab","resolution":{"observed_at":"2026-08-05T10:59:04.186557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20052","last_updated":"2025-04-11T05:07:41Z","snapshot_observed_at":"2026-07-06T19:24:22.008202Z","submitted_at":"2024-09-30T07:57:13Z","title":"Mitigating Propensity Bias of Large Language Models for Recommender Systems","version":2},"cited_work":{"arxiv_id":"2409.20052","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.20052","snapshot_observed_at":"2026-08-05T10:59:03.880108Z","title":"Mitigating Propensity Bias of Large Language Models for Recommender Systems","venue":"cs.IR","work_id":"145d5a84-8bc7-4621-a095-161a555a26ca","year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.666344Z"},"links":{"cited_paper":"/paper/2409.20052","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:baae0ba72cea0a4a84dd9812561a96161dbc0486e08e4daed1967c47c83fb014","observation_id":"a6104271-2014-4ff5-882a-0fd750faae88","resolution":{"observed_at":"2026-08-05T10:59:03.884611Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.168336Z","title":"Bayesian graph local extrema con- volution with long-tail strategy for misinformation detection,","venue":null,"work_id":"0ae8cced-a0a6-4c17-94e0-909e5606c706","year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.671061Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:71c8f269918b5bea3c3018ca50b430ef8669daaaf83878b145ccd0ff521e306a","observation_id":"5a151703-f387-4b7c-a33b-01870f8abd63","resolution":{"observed_at":"2026-08-05T10:59:04.172836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.154508Z","title":"Multimodal contrastive training for visual representation learning,","venue":null,"work_id":"d9b6d548-e4bb-4954-abba-586f721ca7a3","year":2021},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.674949Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:ab5e9737d6fb9877428c1186804ff1ec7e4c4796568fcc67c83a4b8d3ca7aeae","observation_id":"2c84d8b3-106c-4213-8176-731d39c0f46d","resolution":{"observed_at":"2026-08-05T10:59:04.158775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.140759Z","title":"Un- derstanding multimodal contrastive learning and incorporating unpaired data,","venue":null,"work_id":"39aa6334-09ac-45d7-97b8-bfbf18bb9faa","year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.678808Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:d9fdc1164a37815e825d2667b6afd1284cb2761e91b414e69fb0625abdba6cda","observation_id":"4ad1fea1-eb67-4e00-ab7a-3fa7535b7696","resolution":{"observed_at":"2026-08-05T10:59:04.144894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.126964Z","title":"Cleanclip: Mitigating data poisoning attacks in multimodal contrastive learning,","venue":null,"work_id":"6f88f818-8520-4555-98c9-65912fc025c3","year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.682747Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:a7a9a4282c1d06b98ef25ddc340ee667869eaa69e1ba89b5b318dc20ef8bd23d","observation_id":"05471e57-bddb-448a-af87-2f6dd24a42f9","resolution":{"observed_at":"2026-08-05T10:59:04.132189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19084","last_updated":"2025-01-31T12:19:14Z","snapshot_observed_at":"2026-08-08T04:02:59.493607Z","submitted_at":"2025-01-31T12:19:14Z","title":"Laser: Efficient Language-Guided Segmentation in Neural Radiance Fields","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19084","snapshot_observed_at":"2026-08-05T10:59:03.686711Z","title":"Laser: Efficient language-guided segmentation in neural radiance fields,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.686711Z"},"links":{"cited_paper":"/paper/2501.19084","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:e0770a3e12a72894b16faa501caf9b9fc29eea2e2e94008c5144683abe834850","observation_id":"04fb8a3e-ff80-4aa2-a2b2-a4a95133f7ea","resolution":{"observed_at":"2026-08-05T10:59:03.686711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18678","last_updated":"2025-07-24T14:53:26Z","snapshot_observed_at":"2026-08-06T14:37:10.525496Z","submitted_at":"2025-07-24T14:53:26Z","title":"Towards Scalable Spatial Intelligence via 2D-to-3D Data Lifting","version":1},"cited_work":{"arxiv_id":"2507.18678","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18678","snapshot_observed_at":"2026-08-05T10:59:03.848723Z","title":"Towards Scalable Spatial Intelligence via 2D-to-3D Data Lifting","venue":"cs.CV","work_id":"4015492e-9d40-45ff-834b-3c93a2544f67","year":2025},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.690938Z"},"links":{"cited_paper":"/paper/2507.18678","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:a0d897ab48890b09474d28e2fabb36534fd58399bf65421b490fbdac4a680d91","observation_id":"56642db1-e878-4898-8ea0-bf66fc8ec381","resolution":{"observed_at":"2026-08-05T10:59:03.853126Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.111933Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":"f2a84f22-a4c0-4b69-a83c-fa28d001a50e","year":2021},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.695039Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:bafcb67f4caf1b8adc5a30ff82b2d702188d48ec5e131424c4432bb2513ff8e1","observation_id":"6951ad92-f3ac-40f7-bc78-72ce2e782f32","resolution":{"observed_at":"2026-08-05T10:59:04.117326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.097681Z","title":"Wav2clip: Learning robust audio representations from clip,","venue":null,"work_id":"3627a855-57e0-4606-a2dd-68acf06763cf","year":2022},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.698978Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:08251393dd95afc9746f063b4d9e7830fdb4ab9ad338876712717bfc3270d950","observation_id":"03f838f6-659f-44f3-b7fe-268de61f396c","resolution":{"observed_at":"2026-08-05T10:59:04.102993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.083664Z","title":"Multimodal- ity helps unimodality: Cross-modal few-shot learning with multimodal 33 models,","venue":null,"work_id":"4d9f491c-1775-4b9a-be01-e733fefc78fd","year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.703026Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:99708e4820faf2c0ac2050f2a7a836880efdc5553bc3760a309707893b0bb0df","observation_id":"be1513a0-5b8f-46ab-90f7-62321c00d0ee","resolution":{"observed_at":"2026-08-05T10:59:04.088738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.069055Z","title":"Ulip-2: To- wards scalable multimodal pre-training for 3d understanding,","venue":null,"work_id":"ed583e13-5cd3-45e2-8127-820d71726a5f","year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.707082Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:37a9689def7e75ad42eaf4d927a1e92912444940e15c8dba11ccf809943812dc","observation_id":"6facda6b-aaf8-4325-a7c1-981487da6235","resolution":{"observed_at":"2026-08-05T10:59:04.074986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.03666","last_updated":"2022-08-18T04:35:48Z","snapshot_observed_at":"2026-08-07T11:52:57.952281Z","submitted_at":"2022-08-07T08:11:15Z","title":"See What You See: Self-supervised Cross-modal Retrieval of Visual Stimuli from Brain Activity","version":4},"cited_work":{"arxiv_id":"2208.03666","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.03666","snapshot_observed_at":"2026-08-05T10:59:03.827084Z","title":"See What You See: Self-supervised Cross-modal Retrieval of Visual Stimuli from Brain Activity","venue":"cs.MM","work_id":"c5224a3d-5a2e-46c6-b8c6-642f7c276851","year":2022},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.710994Z"},"links":{"cited_paper":"/paper/2208.03666","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:62c3e84677ad9d4b1136f31a9c7d43dbc9aa9a208ec05757aec95a4bb0d593b2","observation_id":"7d136ecc-5fbf-4d3e-b07d-d3a0abde39c2","resolution":{"observed_at":"2026-08-05T10:59:03.834209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16910","last_updated":"2024-06-05T16:42:23Z","snapshot_observed_at":"2026-08-01T18:38:27.912527Z","submitted_at":"2024-06-05T16:42:23Z","title":"Mind's Eye: Image Recognition by EEG via Multimodal Similarity-Keeping Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16910","snapshot_observed_at":"2026-08-05T10:59:03.715057Z","title":"Mind’s eye: Image recognition by eeg via multimodal similarity-keeping contrastive learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.715057Z"},"links":{"cited_paper":"/paper/2406.16910","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:42695fc260b6a79a3097c26ee56cd148164de56d20becaa981eb7f2fbd7cb05a","observation_id":"c135a4a0-9c64-49bb-8a6f-01eb8154d138","resolution":{"observed_at":"2026-08-05T10:59:03.715057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16934","last_updated":"2023-06-30T10:46:54Z","snapshot_observed_at":"2026-08-07T22:48:26.748342Z","submitted_at":"2023-06-29T13:33:02Z","title":"DreamDiffusion: Generating High-Quality Images from Brain EEG Signals","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16934","snapshot_observed_at":"2026-08-05T10:59:03.719097Z","title":"Dreamd- iffusion: Generating high-quality images from brain eeg signals,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.719097Z"},"links":{"cited_paper":"/paper/2306.16934","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:23f54b38918dcebb9bc643086305e413ba07c583988edae6c61596f62c8f3e2d","observation_id":"6138795e-d89d-49ea-9b14-47630ce3a504","resolution":{"observed_at":"2026-08-05T10:59:03.719097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.055637Z","title":"Mindbridge: A cross-subject brain decoding framework,","venue":null,"work_id":"1fdf8011-e168-4742-b1f9-45b1175a2b3b","year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.723371Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:5ab3f3b8b464deee1fba6f694af2220627aba38040d376f997d046127e3d3711","observation_id":"39d0f50d-c428-4287-9e62-64b05ec0b166","resolution":{"observed_at":"2026-08-05T10:59:04.060464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.041351Z","title":"Wills aligner: Multi-subject collaborative brain visual decoding,","venue":null,"work_id":"46e91deb-3b38-459e-96a6-e248d70c1b02","year":2025},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.727299Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:502ec9da822acf39214169374da5aa3d5c75f6fd952b3ec234ef87c00039b932","observation_id":"4791f447-b2dd-4fee-a56a-8237303a0372","resolution":{"observed_at":"2026-08-05T10:59:04.046148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.026946Z","title":"Mindtuner: Cross-subject visual decoding with visual fingerprint and semantic correction,","venue":null,"work_id":"8eb18190-efa3-4444-8bdc-88fad3768f2d","year":2025},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.731188Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:14dde95d3ca0d35dea3be7bbca659116048bbf011d58ef4619a8513f865edd51","observation_id":"55342aaf-b99f-440e-9ea9-b1789e15e915","resolution":{"observed_at":"2026-08-05T10:59:04.031282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.013287Z","title":"Gnn-film: Graph neural networks with feature-wise linear modulation,","venue":null,"work_id":"6f3c34f7-66fd-46b1-aa90-970159e0f11e","year":2020},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.734954Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:7f77b4cd42a98ea5c88697d75e073907fd8c192b143c7142d222f7bf78e389e3","observation_id":"4ebb6003-2c46-4ab9-9577-3473f252b353","resolution":{"observed_at":"2026-08-05T10:59:04.017618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00412","last_updated":"2021-09-16T08:32:03Z","snapshot_observed_at":"2026-07-06T11:43:24.789080Z","submitted_at":"2021-09-01T14:45:16Z","title":"Improving Multimodal Fusion with Hierarchical Mutual Information Maximization for Multimodal Sentiment Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00412","snapshot_observed_at":"2026-08-05T10:59:03.739727Z","title":"Improving multimodal fusion with hierarchical mutual information maximization for multimodal sentiment analysis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.739727Z"},"links":{"cited_paper":"/paper/2109.00412","citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:3d2246d09cc1212917da23867109bafad207eae8fa28bc86f27e69c9f79810fd","observation_id":"63774ac1-3f2a-4301-bded-076c38e2c1fd","resolution":{"observed_at":"2026-08-05T10:59:03.739727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:04.000010Z","title":"Boosting multi-modal model performance with adaptive gradient modulation,","venue":null,"work_id":"acb07906-d0a4-468e-92f5-3e7eb6150404","year":2023},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.744738Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:65905e756fd0608283c501204bc932f4ed1323bffa0517f6fce2373481e2d22e","observation_id":"deeea440-0a34-4096-a5cb-b87742cd3952","resolution":{"observed_at":"2026-08-05T10:59:04.004093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:03.986577Z","title":"Suppress and rebalance: Towards generalized multi-modal face anti- spoofing,","venue":null,"work_id":"96b55ce7-e433-418e-8f38-429e1f50c9bb","year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.748713Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:0ad1323764dfc81f10267541e2947a59de463507329c0dbedd7562f370668bce","observation_id":"9cf17fe3-ecb4-4820-bd06-ec7ba42cc7a6","resolution":{"observed_at":"2026-08-05T10:59:03.990748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:03.973062Z","title":"Enhancing multimodal co- operation via sample-level modality valuation,","venue":null,"work_id":"86d94d6f-0f56-4bc8-b41c-82ce6dd87c7d","year":2024},"citing_paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:03.752559Z"},"links":{"citing_paper":"/paper/2509.03433"},"observation_digest":"sha256:b154338f3c642c76be94555895f4f84518dcbe8322cec1ddd1a44bd80bf2a014","observation_id":"294d8b46-4726-4e65-bee6-fe6314960ec8","resolution":{"observed_at":"2026-08-05T10:59:03.977538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03433","last_updated":"2025-09-03T16:03:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T02:19:41.683169Z","submitted_at":"2025-09-03T16:03:59Z","title":"Decoding Visual Neural Representations by Multimodal with Dynamic Balancing"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":3,"verified_fuzzy":37},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2509.03433."}