{"as_of":"2026-08-21T22:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:75f666c841d207dd9921e2959011ac1d3c5bcf21e71ddb3a9492ab1f898b6489","coverage":[{"denominator":111,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:04:39.195997Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01622/citation-record","integrity":"/paper/2608.01622/integrity","json":"/paper/2608.01622/citation-record.json","paper":"/paper/2608.01622"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.893439Z","title":"Z., and Shah, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.893439Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:538de520928470f6651f6fe4ffad18eca259c7bbacaf178ad298c6cb904fbc66","observation_id":"d4d6cad9-49f0-422a-8163-cd0ed5110f49","resolution":{"observed_at":"2026-08-05T00:04:38.893439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.898420Z","title":"Bottom-up and top-down attention for image captioning and visual question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.898420Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:b4d5334b3f55823875fb5e0d4c57619e45d4dea88a6a8e411f6ea1fe588a304b","observation_id":"0ba620a3-e7e4-4466-966f-b2fdd1f77158","resolution":{"observed_at":"2026-08-05T00:04:38.898420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.901884Z","title":"M., Kok, J","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.901884Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:f8b1c1ab45376141a6747d75e1b16c4e951306633300533812bd4fec5f016860","observation_id":"07d317e5-a75a-4f61-9711-5bcdbc272c33","resolution":{"observed_at":"2026-08-05T00:04:38.901884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.904970Z","title":"and Dan, Y","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.904970Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a4b07096af0a6239de48731e82503732925f19d94ca7caeb7c241de31f665a97","observation_id":"5003bf9d-8f76-40cd-b597-9f56d8ea82f7","resolution":{"observed_at":"2026-08-05T00:04:38.904970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.907975Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.907975Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:79717405c6ffe293d984aa4fcfcd84b46dfea47408c850710d06c9f6d378f398","observation_id":"0dc46860-82f4-4438-b7d3-1a302ecb858e","resolution":{"observed_at":"2026-08-05T00:04:38.907975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.911159Z","title":"Deep reinforcement learning with spiking q-learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.911159Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:7c489846c4a8beda3e07267a66759b970a3aefcd4807ddde03f78b2c2da198c4","observation_id":"32aa0153-ef0f-4cff-9bc0-655b9ac741c7","resolution":{"observed_at":"2026-08-05T00:04:38.911159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.914555Z","title":"and Triggs, B","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.914555Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:fb447174ccf858734945c0e4aacb8058befd08bf297babdd793f4b357824b80e","observation_id":"c0c3781f-4e24-4baf-b7cd-0ca638e5e724","resolution":{"observed_at":"2026-08-05T00:04:38.914555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.917404Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.917404Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:9d2e9a8596e87e1c77152ba45807c070f84b6fec0df2bbe7df3d29b0de779891","observation_id":"ec8e1699-cf6a-4908-b003-d109eca2848d","resolution":{"observed_at":"2026-08-05T00:04:38.917404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.923962Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.923962Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:4c42104e596129da9266eac182448ee4f96b48123f8b09f8e5ac5e199b0694e2","observation_id":"738f2b52-c28e-492b-ad5c-ff3552485ddd","resolution":{"observed_at":"2026-08-05T00:04:38.923962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.926812Z","title":"Deep residual learning in spiking neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.926812Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:19bd0d4e2dfd19b45224a457a2cc9aec63ee8364f7262314f8e1a54befd70dca","observation_id":"2a6e4d92-fd87-4293-80ff-4d9ab0c04917","resolution":{"observed_at":"2026-08-05T00:04:38.926812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.929384Z","title":"Large-scale neuromorphic computing systems","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.929384Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:1c41901bff1fbbfc6fe82ed11572ca586934cdc994c85b6735b22b6ec9005eb0","observation_id":"167ce982-ada8-4933-9e04-d42fee87ad2b","resolution":{"observed_at":"2026-08-05T00:04:38.929384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.932113Z","title":"J., Pouget-Abadie, J., Mirza, M., Xu, B., Warde-Farley, D., Ozair, S., Courville, A., and Bengio, Y","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.932113Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:66855e2929514fd6566dc30f22b5aaf0799ba406222687aa483ada2e2e7e87a5","observation_id":"129bbb01-e74f-4f9f-9a14-c08653388535","resolution":{"observed_at":"2026-08-05T00:04:38.932113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.934883Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.934883Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:e8bd468c9f5163af112107d4f5b4ecbb028394726cb0e9e9a69c68f1dbd924cb","observation_id":"30df4755-830d-4ab2-bf1b-b70560bd9e74","resolution":{"observed_at":"2026-08-05T00:04:38.934883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.937658Z","title":"Image captioning: Transforming objects into words","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.937658Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:3ca3a0ccb0201461862945ec5f9776133b65ffb49a288eae4376745b56ae7e8f","observation_id":"942f0df7-df5a-4587-8fc4-059e9bd3d369","resolution":{"observed_at":"2026-08-05T00:04:38.937658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.940452Z","title":"Hybrid macro/micro level backpropagation for training deep spiking neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.940452Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:aea40efdc27c4d7e4836471c305a2433aee4bac472a8445845f77be82864085c","observation_id":"01c6f931-e7fc-4245-8dad-e1523a697a96","resolution":{"observed_at":"2026-08-05T00:04:38.940452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.943239Z","title":"Synaptic plasticity dynamics for deep continuous local learning (decolle)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.943239Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:b36fed7533fb8819a90d4a66afcbda0bff7532d36d6af616271fdbc66a0b56a7","observation_id":"827b871c-fb82-41f9-a33d-711d820edacb","resolution":{"observed_at":"2026-08-05T00:04:38.943239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.946211Z","title":"u chemann, S., Bannert, M., Dementieva, D., Fischer, F., Gasser, U., Groh, G., G \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.946211Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:ba5fefa30f1bb044c5b55f50a2251490228aa2b41ef610a38dff1caa440e219e","observation_id":"5dfc6bd3-c12b-4570-af60-c95ea98ce79c","resolution":{"observed_at":"2026-08-05T00:04:38.946211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.949535Z","title":"K., Sain, A., Chowdhury, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.949535Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:fbd77dd71c647e991ec6f81ac4bd7cad2e580705fc823b5dcc59aef3a6896eb0","observation_id":"ba84672f-623e-4332-b90f-b5e404a9055e","resolution":{"observed_at":"2026-08-05T00:04:38.949535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.955542Z","title":"Multi-head hashing with orthogonal decomposition for cross-modal retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.955542Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:118b83b71383e2029d1f7f91f98ddb4145a99e77c5bf9ec83d59208c7ad20ab6","observation_id":"0b2dd498-8efc-4ff8-bc8e-79e1aad3d700","resolution":{"observed_at":"2026-08-05T00:04:38.955542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.958397Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.958397Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:b3fb87835862fe26f07d361113dc77ec16238610b11da84c47e970cc0d1fe573","observation_id":"dd4ccaab-4df4-466c-9306-3a8399cc0ea2","resolution":{"observed_at":"2026-08-05T00:04:38.958397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.961340Z","title":"Physics for neuromorphic computing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.961340Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:24552fa21ea42de9b3dc2215d456f0d8238e3b977bc5c5148fc06b5b76c31de2","observation_id":"67ae1f24-cee6-42c0-b234-96f326615f65","resolution":{"observed_at":"2026-08-05T00:04:38.961340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.964191Z","title":"X-linear attention networks for image captioning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.964191Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:967662793a8055aae6850ce0d5b266f22ecbc2b1024ce914e9dce6ce8219c0e2","observation_id":"a1cdbe35-97e1-4f2f-bc31-403abbc3e75e","resolution":{"observed_at":"2026-08-05T00:04:38.964191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.970117Z","title":"Exploring models and data for image question answering","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.970117Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:c3e9664de11de3602b888ef59c015d693311bd1c50296e275da9d0b845df6f57","observation_id":"36dd4270-1774-46c0-a018-411b4af6b5c3","resolution":{"observed_at":"2026-08-05T00:04:38.970117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.972794Z","title":"Towards spike-based machine intelligence with neuromorphic computing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.972794Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:192df23584984635d5b453439efe95a70dd581420c77ed512d958e54375f0a9b","observation_id":"9f68c3c3-e250-45d9-9df4-f81e1599d0af","resolution":{"observed_at":"2026-08-05T00:04:38.972794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.975545Z","title":"Going deeper in spiking neural networks: Vgg and residual architectures","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.975545Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:3447de2bafa8291c92cdb49a2de863fd7013431e9be0b224dab2c2b3724d6a54","observation_id":"7a40c62f-b1c0-4b15-ab28-68ca7db108ad","resolution":{"observed_at":"2026-08-05T00:04:38.975545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.978351Z","title":"Knowledge-enhanced dual-stream zero-shot composed image retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.978351Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:248de7d0f8ce3e89aea47ce28d9c96bd76d5169d44175a0471525170d0864f36","observation_id":"752b693d-2a4d-4f29-bbb6-a7f83c7a959b","resolution":{"observed_at":"2026-08-05T00:04:38.978351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.981177Z","title":"R., Masquelier, T., and Maida, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.981177Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:94157ab9b9562fe37a7e0e6bad59749f8eb5abe14177af14a6532b27af4903d8","observation_id":"0a2ef673-d3db-4ef2-a505-e5dae5365293","resolution":{"observed_at":"2026-08-05T00:04:38.981177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.983902Z","title":"T., Malliaras, G., and Salleo, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.983902Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:f9dd764c7077495c70f809c1ce4927e3e9431d2fa1d799cc9264221165b98217","observation_id":"20b92d01-3246-4028-ad0d-a285a1d14419","resolution":{"observed_at":"2026-08-05T00:04:38.983902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.986546Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.986546Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a18abd8e520708d08359b975f40be2d14bc368fa5523891ecd0287d6f1c7f85e","observation_id":"c0eb721b-181d-4854-90a5-544b6a9d9a50","resolution":{"observed_at":"2026-08-05T00:04:38.986546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.989294Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.989294Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:c917b530817d02aa01c5e96e4e291e39e3b9049b60b0ab9b344a5352cde77b25","observation_id":"a0f0abcb-a5df-4bd0-b059-7a6cf8ae86eb","resolution":{"observed_at":"2026-08-05T00:04:38.989294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:38.992191Z","title":"End-to-end transformer based model for image captioning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.992191Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:21e3d139f00cc3c2fce146102d5cabdb18795df3b7ff981538d1b678323ca4ad","observation_id":"4f36922d-e650-477d-bb07-69777e88a8c6","resolution":{"observed_at":"2026-08-05T00:04:38.992191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.948267Z","title":"Spatio-temporal backpropagation for training high-performance spiking neural networks","venue":null,"work_id":"dbc26ba7-792b-47b3-adeb-0a13c8c23bcb","year":2018},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:38.998077Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:5566e33462474b87b0528e6ea0009e5937802595ebe0c5bd271221cef138da16","observation_id":"5a8f841e-bf8a-4948-96dd-3289a71b8659","resolution":{"observed_at":"2026-08-05T00:04:39.951470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.938729Z","title":"Video graph transformer for video question answering","venue":null,"work_id":"2e3050ea-fe76-4ce3-a30a-c7ec41712d39","year":2022},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.000747Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:423d1064c4a3126767d4a6739bbff35d0f6ab27af2d5185d5eae0a5897919d01","observation_id":"5d13f1e0-b50e-4f8d-8c4a-5aa32dade49e","resolution":{"observed_at":"2026-08-05T00:04:39.942346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.929296Z","title":"Image-text retrieval with main semantics consistency","venue":null,"work_id":"ab983f63-0e1c-45c0-9265-00ab5347a058","year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.003640Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:cef0386c61c4ba7102f31a135820ad77cd6ddabfe31226489aa1205cb1451762","observation_id":"a442a084-7d61-4795-b7a2-9c0cfd0670d5","resolution":{"observed_at":"2026-08-05T00:04:39.932334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.919650Z","title":"Msr-vtt: A large video description dataset for bridging video and language","venue":null,"work_id":"e894553e-d4ad-431f-b385-274309f9f1fc","year":2016},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.006266Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:ff15356477ed91c62a6800788c3357a93ce921a864b4888ffa8d1cc497e66e15","observation_id":"2112d2a4-0dfb-4c7b-90ef-f230e27e3935","resolution":{"observed_at":"2026-08-05T00:04:39.922921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.910445Z","title":"Show, attend and tell: Neural image caption generation with visual attention","venue":null,"work_id":"af86c9b4-830a-408b-93fe-87e59a694bbb","year":2048},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.008782Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:0911499214418551baac5be08808dfc6fb012f8d5d3f2d7b441c10eea93dcc67","observation_id":"89ff1ae3-92b4-42c5-8434-2db52418fb88","resolution":{"observed_at":"2026-08-05T00:04:39.913625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.901130Z","title":"Dense captioning with joint inference and visual context","venue":null,"work_id":"5c035b6b-0c54-4c63-ba63-7fdc96c3b3aa","year":2017},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.011469Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:eb91d63c51c338b6fdac7c376f9e7010aabbfbf888d4f9cd6016dcb40be0a20e","observation_id":"949722b1-302f-4e22-8c84-e64d74f9208c","resolution":{"observed_at":"2026-08-05T00:04:39.904520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.891231Z","title":"Stacked attention networks for image question answering","venue":null,"work_id":"b628234a-8c02-431e-a878-41cfc378a9c3","year":2016},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.014339Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:1b4659766a8754f9a9913e54f31531db7b3af9fa5cd5a71b45cb295c40f11f3a","observation_id":"02a4e357-ae13-4774-990a-9c81db9d0d34","resolution":{"observed_at":"2026-08-05T00:04:39.894931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.881068Z","title":"Spike-driven transformer","venue":null,"work_id":"b3f643df-47e0-4a79-b1be-b89f3d5121e3","year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.017036Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:1840af4aeebf2021b96b8a4e39eaed281c31eda743d99a8655159e264a6ab409","observation_id":"093f969d-3d84-4b9e-a747-7bf5ede89a80","resolution":{"observed_at":"2026-08-05T00:04:39.884137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.871127Z","title":null,"venue":null,"work_id":"580c41a0-c165-4749-accc-fa81f50f0309","year":2021},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.019624Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:d2ade6dceeadf814dcaefb14beff76be060b466161d79e456ffba1a66a9ea77e","observation_id":"c92b0709-551d-48e0-a4a2-f46caccf30a2","resolution":{"observed_at":"2026-08-05T00:04:39.874278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.860860Z","title":"Meacap: Memory-augmented zero-shot image captioning","venue":null,"work_id":"c115ce97-6836-4d7a-940a-5d8df8eb0cf6","year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.022420Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:c6b5f046b5bffaa37817959765312ff0d0aa8a45abef5763bf2e4781d3ec0206","observation_id":"c224a275-3b3a-4b91-b9a4-cfc4aeab9714","resolution":{"observed_at":"2026-08-05T00:04:39.865014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.851217Z","title":"and Li, P","venue":null,"work_id":"ee0a1fb9-16b8-4071-a19f-e4de992f9540","year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.025078Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:731799b7c914e673b91af4b9498cb7f6cf532e21ff41ea7b70eb88cc469bb85d","observation_id":"71389c4d-b4b2-4801-b848-82659bf58560","resolution":{"observed_at":"2026-08-05T00:04:39.854524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.841549Z","title":"Nature , volume=","venue":null,"work_id":"d13405f1-a761-4aff-8cc6-c6ca5d53dd5c","year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.030944Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a9b22d1334ceb00dcbdfa424d202b2baa686becba3c26b3907a053199a8e3ae0","observation_id":"d337c1af-48dd-4eec-981f-e83885ab0543","resolution":{"observed_at":"2026-08-05T00:04:39.844604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.033777Z","title":"Neural networks , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.033777Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:0390e9bc3bcf90779eb7cc306bd4257189fd477d82fa72d6369a35b3b0d7df53","observation_id":"82fb08f5-a0de-44ae-b9ae-df3ef7013d6a","resolution":{"observed_at":"2026-08-05T00:04:39.033777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.036907Z","title":"arXiv e-prints , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.036907Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:94b897b093e6c532692e5255524fe1941424983f3b62f0d9e94743abd438736f","observation_id":"efff0e23-bcd5-4d1d-b325-14811fdcc0f9","resolution":{"observed_at":"2026-08-05T00:04:39.036907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.818851Z","title":"Frontiers in neuroscience , volume=","venue":null,"work_id":"c4904b55-8c98-42e8-a26a-ded40f859205","year":2018},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.040004Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:fc88a11d7ddda324485a32a78c92865dd696897cec292765724e9c0bfdc2b6ac","observation_id":"fa3a650c-77ce-4f31-94a5-51d1f23a9f78","resolution":{"observed_at":"2026-08-05T00:04:39.821918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.043022Z","title":"2005 , publisher=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.043022Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:41ab7fe64ad8d148536643b09025c808aeffce33bdf18a7866c65b5a1caf60e9","observation_id":"2b727aec-b421-4acc-abd5-f4d50cc2665b","resolution":{"observed_at":"2026-08-05T00:04:39.043022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.802836Z","title":null,"venue":null,"work_id":"d3aa229b-d360-45dd-9464-d1cd3751f817","year":2008},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.045998Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:0f51a8dda9f1d0ade70cec97ff9dab3222c408239984cc16f454390a994d805f","observation_id":"b58fb985-0eeb-4c9a-8d5f-340c274cbfa3","resolution":{"observed_at":"2026-08-05T00:04:39.805893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.793795Z","title":"Frontiers in neuroscience , volume=","venue":null,"work_id":"a1902458-10fc-4557-a87a-72e00fbb284a","year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.048945Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:b555ea0feabc5e25eb7f31b014f0a4236110e4fec0b192a21360dc111a381323","observation_id":"c79f4b60-93fe-42f7-a30f-204447d694a9","resolution":{"observed_at":"2026-08-05T00:04:39.796875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.784562Z","title":"International Journal of Computer Vision , volume=","venue":null,"work_id":"d7cc22e9-9fee-4f62-8d2c-4e66b5e1420d","year":2015},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.051718Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:62dfbcaa85763285bd38e18209bc12ae73c3173d41cd6ce39174cccb465d8125","observation_id":"dc6e38e0-8473-492b-b897-7954351718e3","resolution":{"observed_at":"2026-08-05T00:04:39.787872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.775233Z","title":"IEEE Transactions on Neural Networks and Learning Systems , volume=","venue":null,"work_id":"c2f7a7f1-a017-4ec6-b126-ee3dba252c09","year":2021},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.054484Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a481cf4e6e04f14acbe2222664770f48b5ead2fa77d22ec75a509e87b1ee02f3","observation_id":"4a5667eb-071a-44bd-96c2-a2c5623df6ef","resolution":{"observed_at":"2026-08-05T00:04:39.778396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.765800Z","title":", author=","venue":null,"work_id":"77c1263f-6c2b-4a88-98eb-c539bc58751f","year":2000},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.057199Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:9385d19981a20ae963cbd39c5beec5270b1c230511118e5cd15ff8a3f312d161","observation_id":"deccf3e8-97ee-4142-8d1e-2b4842dd93dc","resolution":{"observed_at":"2026-08-05T00:04:39.768682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.060230Z","title":"Frontiers in neuroscience , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.060230Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:74c4144827094c12e422636afde7afd3f1f59188c6a5e5fb63ef3c4d639f8680","observation_id":"e308161c-2b9c-41d3-9fb3-ae24af30b45d","resolution":{"observed_at":"2026-08-05T00:04:39.060230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.750447Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"776336f9-b028-4cbe-8756-95560ec2e9a0","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.063260Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a70cda5be9ab32caf76c8f5e2125c9109654e414f54f806122351de4a608acd5","observation_id":"f1023c4d-85e5-4101-a636-a25ebad06560","resolution":{"observed_at":"2026-08-05T00:04:39.753716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.741372Z","title":"Frontiers in Neuroscience , volume=","venue":null,"work_id":"0a2be6bd-d506-442c-a657-b2b1539e68d3","year":2020},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.066426Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:90a3d97a3df47735c5a18c4a558baa54bb61fa60cc46ead23654b7c35fb38370","observation_id":"cc7796f5-0e21-41c6-9dbe-b6b81a27aae7","resolution":{"observed_at":"2026-08-05T00:04:39.744477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01807","last_updated":"2020-05-04T19:30:43Z","snapshot_observed_at":"2026-08-17T01:47:28.349622Z","submitted_at":"2020-05-04T19:30:43Z","title":"Enabling Deep Spiking Neural Networks with Hybrid Conversion and Spike Timing Dependent Backpropagation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01807","snapshot_observed_at":"2026-08-05T00:04:39.069240Z","title":"arXiv preprint arXiv:2005.01807 , year=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.069240Z"},"links":{"cited_paper":"/paper/2005.01807","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:eb930c21c2be65ca129abb9c517990c50e25c9636b913c9510b2db7e2c487822","observation_id":"7414da1d-0783-4333-9242-f82a4627ba2c","resolution":{"observed_at":"2026-08-05T00:04:39.069240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.072050Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.072050Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:79e2aeb2f8a85233a321c346d7d676687822d0ac537147a890bc6487f66c28f3","observation_id":"3663528e-1581-4359-b9d4-c008bd919c82","resolution":{"observed_at":"2026-08-05T00:04:39.072050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.724451Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"ff9b0a37-a3d0-497a-b97b-87f16a6cafb7","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.075061Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:daf77e10879c6223e8bf79031a375ec0eb7baef320e18e1412b334aca3c51f46","observation_id":"333bed33-2b2f-4aae-9481-3e02556b0055","resolution":{"observed_at":"2026-08-05T00:04:39.727631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.715174Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"1a7d4f88-74e3-4641-9928-132c7409d72a","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.078120Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:27a6ad1d6df384844b6aff955c529a91742372db074911cfa03c93a1bd369d65","observation_id":"d27291c8-b48f-4d3e-9d00-3f066f537e37","resolution":{"observed_at":"2026-08-05T00:04:39.718390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.081515Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.081515Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:22663c784545b6387e2d398d080838da12f6d5913b5f579a53369b3864351f49","observation_id":"f55c3f37-d665-4675-963f-898bcf138686","resolution":{"observed_at":"2026-08-05T00:04:39.081515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15425","last_updated":"2022-11-22T12:45:05Z","snapshot_observed_at":"2026-08-16T19:39:28.061719Z","submitted_at":"2022-09-29T14:16:49Z","title":"Spikformer: When Spiking Neural Network Meets Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15425","snapshot_observed_at":"2026-08-05T00:04:39.085741Z","title":"arXiv preprint arXiv:2209.15425 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.085741Z"},"links":{"cited_paper":"/paper/2209.15425","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:bb78a472572c5ce18bf21ca6aba63a4c193173cde71f23fc80c7d744490193da","observation_id":"8ba6ba3a-4cbd-4c0a-bc0e-20daec102149","resolution":{"observed_at":"2026-08-05T00:04:39.085741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.698343Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"fc095575-d033-4593-9b8c-6ba6976e507d","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.088406Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:eb452c831d7d9058e7bd7ded05e410f5efa55f63807a3bc8093564e5beb92680","observation_id":"470a4e35-99ec-48fd-b4c9-bde064189638","resolution":{"observed_at":"2026-08-05T00:04:39.701679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.688093Z","title":"Proceedings of the seventh IEEE international conference on computer vision , volume=","venue":null,"work_id":"12eca1d6-1c3b-45d3-845b-e6a00d31e2d0","year":1999},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.091243Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:b83f936a05886723ce3ce32d1acc91c7fa707be3d97d766759dfdddf5ff9f72d","observation_id":"412c9c9f-fdf8-4d13-afea-d42764be1fe9","resolution":{"observed_at":"2026-08-05T00:04:39.691710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.093988Z","title":"2005 IEEE computer society conference on computer vision and pattern recognition (CVPR'05) , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.093988Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:4f4b202fefcad8b18245e43195416a6c16f2afe65e2e3daec2eded194eb756cc","observation_id":"7884396d-2de9-41e9-9ab0-4ab9eecc68bc","resolution":{"observed_at":"2026-08-05T00:04:39.093988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.672045Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"29cbc40d-45a4-4bd3-ab2a-987b6aa4983f","year":2015},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.096969Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:2f78e397ceeaf98029ddc6a093b9892174261e2854e94de12ca5c52f382bcbfd","observation_id":"29fc4fd4-1837-4e77-b35d-1c6f62fef944","resolution":{"observed_at":"2026-08-05T00:04:39.675253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.661230Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":"105fd1c7-6afd-4e69-869c-b0cef15dd15c","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.099654Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:73c759e622bfca090a6761bd7d796c248ca860ac3f6285e4ea43b110deafa169","observation_id":"a8ceb0c8-69e8-44f0-b464-031996ceda87","resolution":{"observed_at":"2026-08-05T00:04:39.664763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.651088Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"828748a3-8189-4576-8571-5f83ea9e0a3b","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.102676Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:c6a6474b0cd4bdafaade4a0f452dc9d0d35d21e38214419b93718d5e723e215c","observation_id":"d3536674-c155-4fc0-b472-7464e073bf54","resolution":{"observed_at":"2026-08-05T00:04:39.654596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.640819Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":"ad2d8f89-43f2-40c7-8156-e5a597136c0b","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.105460Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:1a3ffc48d4101d4869d44b63895a54940a260a6475a517517bcccb2f7af6d438","observation_id":"083256be-fa50-44e6-8e61-c94b29c24947","resolution":{"observed_at":"2026-08-05T00:04:39.644426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.630534Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"3668deae-84b0-495a-94c1-31dff8af24fd","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.108831Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:4bcb45fbfa57c0390900ea89eb97d270a97945d38d1b47176c7163e2ffb5de05","observation_id":"bc802ecb-7476-4f05-95d0-38d7bb4648c1","resolution":{"observed_at":"2026-08-05T00:04:39.633874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.621075Z","title":"Proceedings of the IEEE international conference on computer vision , pages=","venue":null,"work_id":"888c4995-8dc5-4857-8e66-c2af697c3152","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.111557Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:8e2a35c17fe8c40b2098a2f0273d9e1511c22a7a24fdaf24b4783f597a02e09d","observation_id":"dc90a632-7335-4432-b0fb-28ea40ed4de8","resolution":{"observed_at":"2026-08-05T00:04:39.624348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.610808Z","title":"Proceedings of the IEEE international conference on computer vision , pages=","venue":null,"work_id":"9ade695b-2659-4b42-9c51-b734092d431e","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.114323Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:985e554d57bfbafdc05e6af2cb711e1008d414a6df7583010323ff4b06a2f5d8","observation_id":"c5e03ea0-4eba-49d1-9ebe-286aa073cbf5","resolution":{"observed_at":"2026-08-05T00:04:39.614469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.601260Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":"54e6986b-563b-411f-b44a-48be2fe4e348","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.117134Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a97f31a3e1c146adb1c103b5dc3a2b9fb0093513503458afbfdecacd7c2a587a","observation_id":"cdb7e822-28aa-477c-a44e-c9be21ecffa4","resolution":{"observed_at":"2026-08-05T00:04:39.604578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08829","last_updated":"2015-10-29T19:24:03Z","snapshot_observed_at":"2026-08-14T22:25:41.651073Z","submitted_at":"2015-10-29T19:24:03Z","title":"Spiking Deep Networks with LIF Neurons","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08829","snapshot_observed_at":"2026-08-05T00:04:39.120010Z","title":"arXiv preprint arXiv:1510.08829 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.120010Z"},"links":{"cited_paper":"/paper/1510.08829","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:76e5bb9b1a78ebb2690904d81504cc3697184f7b1c4caceff1b2b4b5a774d493","observation_id":"ce049a2c-6e41-4113-a79b-d31cfae57d5c","resolution":{"observed_at":"2026-08-05T00:04:39.120010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.589792Z","title":"Frontiers in neuroscience , volume=","venue":null,"work_id":"549713e1-bd04-4ded-8156-6e618f9401c7","year":2017},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.123353Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:7f4829b75acde3548a185f077942a0279004c0b94337c73b0980730343966b45","observation_id":"d57ab4c7-c949-465f-ae3d-b90415a9e1e7","resolution":{"observed_at":"2026-08-05T00:04:39.594853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.126131Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.126131Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:46e5a27f3f70e15813aaca7d7018a03c4e0f5195b9f777b0e5b5f4feb1c63890","observation_id":"f6d0e3d2-7ff4-46e0-813a-3b65aedd1e10","resolution":{"observed_at":"2026-08-05T00:04:39.126131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.574191Z","title":"Frontiers in neuroscience , volume=","venue":null,"work_id":"b11fa572-1daf-49b5-918a-03f86abb84a0","year":2020},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.128955Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:38a56d284b514851f1a6f9a7b0a8b10aff7a530362f8aec2236b51c1ec363802","observation_id":"bf6aa32f-2295-4281-9974-0f42e851a29d","resolution":{"observed_at":"2026-08-05T00:04:39.577235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.03658","last_updated":"2020-12-02T02:55:31Z","snapshot_observed_at":"2026-08-21T18:52:54.776605Z","submitted_at":"2020-08-09T05:07:17Z","title":"DIET-SNN: Direct Input Encoding With Leakage and Threshold Optimization in Deep Spiking Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.03658","snapshot_observed_at":"2026-08-05T00:04:39.131894Z","title":"arXiv preprint arXiv:2008.03658 , year=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.131894Z"},"links":{"cited_paper":"/paper/2008.03658","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:5667d9132b80b1b70b53630f983c1d40ed62a51c7e230296e9da8300d755ba74","observation_id":"e9f57887-21e8-40f7-bc89-0ca5ab11bbb8","resolution":{"observed_at":"2026-08-05T00:04:39.131894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06386","last_updated":"2023-04-19T09:09:13Z","snapshot_observed_at":"2026-08-16T16:24:46.162235Z","submitted_at":"2022-10-12T16:39:46Z","title":"Multi-Level Firing with Spiking DS-ResNet: Enabling Better and Deeper Directly-Trained Spiking Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06386","snapshot_observed_at":"2026-08-05T00:04:39.134784Z","title":"arXiv preprint arXiv:2210.06386 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.134784Z"},"links":{"cited_paper":"/paper/2210.06386","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:e8d08ecbf15097e10dd165d4eda21baf58c6df923a9f98f06d4b7ff0ced3f931","observation_id":"3d371be4-e9c0-4598-b64a-a8efa7094959","resolution":{"observed_at":"2026-08-05T00:04:39.134784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.137796Z","title":"Proceedings of the IEEE/CVF international conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.137796Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:750c05a06ca960796ed318a6d334a25f5bed3295f2d1158dfd33538474c2d8a8","observation_id":"7bd2c94e-ecfd-47e8-a6d7-cf735c882ca5","resolution":{"observed_at":"2026-08-05T00:04:39.137796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.558358Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"0352bdc8-e8e0-44d3-ba6f-8c66057d4430","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.140478Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:8031d99a4de3bc181f3d5bed72c48b524b8c07cc24e15e37ee2125fdad7752e5","observation_id":"7ce73f90-ca48-446f-a817-926e17483443","resolution":{"observed_at":"2026-08-05T00:04:39.561779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.549248Z","title":"2024 , eprint=","venue":null,"work_id":"d0c8ac09-1dd7-4266-aaf6-1d2673ecdebd","year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.143262Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:313228365742bdb6444081829ea37c8223e1417721d04cda7b3d88c7cb6094fb","observation_id":"1530803a-0871-404b-a140-996c1c222efe","resolution":{"observed_at":"2026-08-05T00:04:39.552295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.145883Z","title":"2014 , eprint=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.145883Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:24bba1dbb4fc95f121868ba7b3883a24fb0dd66052e746a729b636642d50d811","observation_id":"7b6eccdf-41ef-4a30-8887-90c03cb08d98","resolution":{"observed_at":"2026-08-05T00:04:39.145883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.148390Z","title":"Learning and individual differences , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.148390Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:c6151244e0f3ac7ec8f8a6a5684af81def51331df0a604ca5fc64d58c84d7ba6","observation_id":"12433f89-5ddb-425f-be4f-8e285d9210e6","resolution":{"observed_at":"2026-08-05T00:04:39.148390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-05T00:04:39.150957Z","title":"arXiv preprint arXiv:2402.17177 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.150957Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:7fc2053aec33780a3f09f985ea855c20bd9191d65b29c21a8bdc48938f2c1bd2","observation_id":"1f9ef434-0ad8-4530-aac0-a285e5b37db3","resolution":{"observed_at":"2026-08-05T00:04:39.150957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.527948Z","title":"2024 , eprint=","venue":null,"work_id":"86a2a361-5c02-442e-b5cb-56052e2fc508","year":2024},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.154175Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:67eb3088f08da35db3e14eb3d6b18390fc2e3dde30e3ebf25c3f5bacc5deed2d","observation_id":"c0037047-4b12-4824-917d-98d9f9fbacf6","resolution":{"observed_at":"2026-08-05T00:04:39.531062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-17T00:14:01.413100Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-05T00:04:39.156763Z","title":"arXiv preprint arXiv:2206.07682 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.156763Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:21822664824a351fa6d57d866dc09e9dea1f5e5b6187519ded7879a3bd303dc8","observation_id":"b54be26f-8400-4155-9488-491c3784ff35","resolution":{"observed_at":"2026-08-05T00:04:39.156763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.159278Z","title":"30th USENIX Security Symposium (USENIX Security 21) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.159278Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a6529190bf1abf3f8f0bd1aba6c957866b03dbc4a8e647c8b11791482bc8271f","observation_id":"b052cd19-568f-4ab5-8be1-ead3fd8872ce","resolution":{"observed_at":"2026-08-05T00:04:39.159278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.510474Z","title":"ACM Transactions on Intelligent Systems and Technology , year=","venue":null,"work_id":"0c64e973-e64d-4a65-8f90-66e093a09e0c","year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.162142Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:d12042e50b80df17eb2b19e46c5c739f7beac7b794f3c6552b968780949c232e","observation_id":"ea51b90f-86f1-4689-a215-eef58b8de609","resolution":{"observed_at":"2026-08-05T00:04:39.514024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.500332Z","title":"IEEE transactions on pattern analysis and machine intelligence , volume=","venue":null,"work_id":"8197250b-f45b-4864-adcf-f4e002e21d63","year":2013},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.164921Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:19f45b77aad3dd61efd99cc97cd5cd5bb6cb3521282d1d4f624f2d46532eba1e","observation_id":"5a28d17c-a664-4731-9c28-47b734dc323e","resolution":{"observed_at":"2026-08-05T00:04:39.503693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.167577Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.167577Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:cc1cf3035a3dd8cba3515a37b4b4bec765f9f99aea3465f760472119e5639bf9","observation_id":"f05daf49-aaa6-49c3-aa9d-a4452ec34a86","resolution":{"observed_at":"2026-08-05T00:04:39.167577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.170309Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.170309Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:87e1da1eafd6928de36c4e0555e87515ed676096cc747989ce599a3a18d4af57","observation_id":"88db3d57-7cd6-4c44-b330-f2c3dd495664","resolution":{"observed_at":"2026-08-05T00:04:39.170309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.173038Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.173038Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:97634311b5f9adb9882f252eb5d262756c071ce8da2156ad36f9607f28c9ff7f","observation_id":"d788d140-6fb1-4cdb-b10a-e99140c4dbc6","resolution":{"observed_at":"2026-08-05T00:04:39.173038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.176328Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.176328Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:2ae06d43ddfb560fc4d362db50f33ff95c4651a70688a84ef98a52a5364283bb","observation_id":"2afbb9cc-f971-4779-85cc-e0230b13170b","resolution":{"observed_at":"2026-08-05T00:04:39.176328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.465855Z","title":"ACM Computing Surveys (CSUR) , volume=","venue":null,"work_id":"72e5a4cf-e160-402c-81af-20b829fbdd9c","year":2019},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.179322Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:a712b0322645c098342991ee287ef4134af2e41fde89d38698ad0c683a151070","observation_id":"9e490cd2-6568-4aee-8fae-cbe810299e4e","resolution":{"observed_at":"2026-08-05T00:04:39.469105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.182164Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.182164Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:51e0cb97716d118abdf7b4e2dcf99c187cdf52b9272e9e2e05c63b209eed0a66","observation_id":"ecb4e247-20e5-4bfe-977a-f4cb4cf3b491","resolution":{"observed_at":"2026-08-05T00:04:39.182164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.185149Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.185149Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:0e79ee9fdac82befe6d094df139b6f1a0c3f65dfcffc39317c300d424136306a","observation_id":"dc8b235c-e2b1-401b-9ee4-3411b7f6d2f2","resolution":{"observed_at":"2026-08-05T00:04:39.185149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.01696","last_updated":"2019-05-07T21:34:05Z","snapshot_observed_at":"2026-08-14T18:32:30.931998Z","submitted_at":"2018-09-05T19:14:11Z","title":"TVQA: Localized, Compositional Video Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.01696","snapshot_observed_at":"2026-08-05T00:04:39.187854Z","title":"arXiv preprint arXiv:1809.01696 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.187854Z"},"links":{"cited_paper":"/paper/1809.01696","citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:cd9c08021407661686d63a71675c6a9acb4ed50406cf3cc04a9c0e22432ec94f","observation_id":"b3c0b9e3-45cf-4c93-a5cc-c52cc9c1e387","resolution":{"observed_at":"2026-08-05T00:04:39.187854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.444574Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"0dad9369-3893-4bf2-9b75-1f31c8db426a","year":2022},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.190340Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:c7dc54b3dcfaab3e58de4a5f22b5864d3abe6ee07de9d56ed4698a893250c922","observation_id":"a615a5f9-fd79-4eee-99b8-b3ec24e7b8ae","resolution":{"observed_at":"2026-08-05T00:04:39.447525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.193192Z","title":"Nature Reviews Physics , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.193192Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:aef9479cccb545bf3be6d18454f3af3bcf1a0f05692b7be9ef29b8b42620c7af","observation_id":"74305918-fd9e-4503-87c1-ad82a5777081","resolution":{"observed_at":"2026-08-05T00:04:39.193192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:04:39.429437Z","title":"Journal of neural engineering , volume=","venue":null,"work_id":"bbf30fe4-2a62-4231-bfcd-a12577d732cc","year":2016},"citing_paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-05T00:04:39.195997Z"},"links":{"citing_paper":"/paper/2608.01622"},"observation_digest":"sha256:18604048c1489e0388913e4e43ab93618c73347ba90cab5906edf01244a0578e","observation_id":"d39ad92f-3df6-48e6-8f98-ed97202ee716","resolution":{"observed_at":"2026-08-05T00:04:39.432319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01622","last_updated":"2026-08-03T02:54:28Z","latest_version":1,"primary_category":"cs.NE","snapshot_observed_at":"2026-08-20T09:26:08.463677Z","submitted_at":"2026-08-03T02:54:28Z","title":"SMM Transformer: Leveraging Spiking Neural Networks for Multimodal Tasks"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":60,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":111},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 100 of 111 outbound references and 0 inbound Pith citation observations for arXiv:2608.01622."}