{"as_of":"2026-08-19T00:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76dd49f1ed63fe90a3624175580f166450d225795fbfc96fc4a8503695f79e69","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:41:21.642571Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:43:25.901211Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T15:51:38.997059Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05540","snapshot_observed_at":"2026-08-15T20:43:25.901211Z","title":"Towards 3d acceleration for low-power mixture-of-experts and multi- head attention spiking transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12292","last_updated":"2025-05-18T08:07:44Z","snapshot_observed_at":"2026-08-17T06:28:47.750132Z","submitted_at":"2025-05-18T08:07:44Z","title":"SpikeX: Exploring Accelerator Architecture and Network-Hardware Co-Optimization for Sparse Spiking Neural Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:43:25.901211Z"},"links":{"cited_paper":"/paper/2412.05540","citing_paper":"/paper/2505.12292"},"observation_digest":"sha256:79122875b3cfcc27927935540164907fb5ad085594785e3deba2039982e17d20","observation_id":"8aa85490-e6c9-4ede-adb9-6bb8a5c07066","resolution":{"observed_at":"2026-08-15T20:43:25.901211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"cited_work":{"arxiv_id":"2412.05540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Our paper is narrower: we make a speciﬁc, falsiﬁable claim about three mechanisms in MoE routing, motivate each from the FEP equations, and validate it empirically","venue":null,"work_id":"1255ca30-2445-4618-89be-94c88f05585d","year":null},"citing_paper":{"arxiv_id":"2605.00604","last_updated":"2026-05-01T12:18:55Z","snapshot_observed_at":"2026-07-06T23:14:01.852096Z","submitted_at":"2026-05-01T12:18:55Z","title":"Affinity Is Not Enough: Recovering the Free Energy Principle in Mixture-of-Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T19:10:18.888463Z"},"links":{"cited_paper":"/paper/2412.05540","citing_paper":"/paper/2605.00604"},"observation_digest":"sha256:377f9c627cc47f2475b88740070a50ecfc699c20ef13c0fda1658260bfca012e","observation_id":"1a9c8c84-c348-4d5d-8571-33d990d5e2c5","resolution":{"observed_at":"2026-05-11T15:51:39.113913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.05540/citation-record","integrity":"/paper/2412.05540/integrity","json":"/paper/2412.05540/citation-record.json","paper":"/paper/2412.05540"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.490482Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.490482Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:895e7e9ec223d8fc5cf9fafd67eac6d7b6503bd333029ceb0c5b9a5592ad415c","observation_id":"fc710e34-59b4-4380-ab50-e3dab07a61f4","resolution":{"observed_at":"2026-08-11T20:41:21.490482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.260288Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":"1dcb8da3-7c39-4c65-b6b5-eb5ddad744ae","year":2021},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.497115Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:8c35906201974848b3131eae5cb1893d5b0b2a1fedfe5ecca0c980c0cc41bb00","observation_id":"e4b5cca8-1401-4f7e-b55f-14dfc5164697","resolution":{"observed_at":"2026-08-11T20:41:22.264997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-11T20:41:21.502618Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.502618Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:899e101871492cb8a8f93e52320f613fc511d4e80031f244849277e87f1dd723","observation_id":"a07b0ed2-e6b8-4132-8281-57948c57aafd","resolution":{"observed_at":"2026-08-11T20:41:21.502618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.246020Z","title":"Unified scaling laws for routed language models,","venue":null,"work_id":"fafafaae-f240-4577-81e2-a6481456a2eb","year":2022},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.507634Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:d94915c3d2cfca62d3d284257ed95140270eacd006a3ba9ccd2988156b706d4d","observation_id":"01231065-4c37-4995-a696-df65663d7198","resolution":{"observed_at":"2026-08-11T20:41:22.250930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.519139Z","title":"Scaling vision with sparse mixture of experts,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.519139Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:9bde6819aa6b791be3a9497b2a49be31f0db9e47c12afea841dd8c4d443ac7d1","observation_id":"630c04d3-6f97-4d36-8d79-ef099dfdd46c","resolution":{"observed_at":"2026-08-11T20:41:21.519139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.217968Z","title":"M3vit: Mixture-of-experts vision transformer for efficient multi- task learning with model-accelerator co-design,","venue":null,"work_id":"bfc46c69-1fb9-4b2c-96a8-33f215925048","year":2022},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.526321Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:7ba856579a20883d25b3fea5c5133a5bed8a503b09b0201293a92fdaa08db347","observation_id":"b0469497-c796-44f9-9bbb-8f807b467062","resolution":{"observed_at":"2026-08-11T20:41:22.226290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.202185Z","title":"Networks of spiking neurons: The third generation of neural network models,","venue":null,"work_id":"4337a95e-d24a-4db7-a1ea-e0cf67c299ca","year":1997},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.534114Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:7eda5b76f65dee3a71fa7df961441c429930d9e70127269e18c339cfd0819fbb","observation_id":"1dd75d63-800d-4c3b-a0e0-d562a164bcb6","resolution":{"observed_at":"2026-08-11T20:41:22.207769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.188368Z","title":"Towards spike-based machine intel- ligence with neuromorphic computing,","venue":null,"work_id":"6e483bd2-d204-4c6e-a8de-231d5cf3213c","year":2019},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.540861Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:74557c6009d412d5e500d9b91d6d677602b20403e518c33216b281f3ad1cbc53","observation_id":"d7eabd5c-0990-4a42-af51-2e010b8588c7","resolution":{"observed_at":"2026-08-11T20:41:22.192790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.174577Z","title":"Truenorth: Design and tool flow of a 65 mw 1 million neuron programmable neurosynaptic chip,","venue":null,"work_id":"bba99b11-d8f4-4f40-b73b-ebbe50385d16","year":2015},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.546070Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:e4247ce04e5eb39d7997d72eca71bdd234a41b5821a97e67854a6b9288d97a5c","observation_id":"abc41cbd-dc55-4c6e-bd83-07b1e49cbee6","resolution":{"observed_at":"2026-08-11T20:41:22.179121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.552958Z","title":"Loihi: A neuromorphic manycore processor with on-chip learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.552958Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:f97f334b28e00a7b4ed05db9a348ed555c05663528189adf9721588de6f17f76","observation_id":"bcc1ecce-cd5d-4e50-aed4-85d9e761055c","resolution":{"observed_at":"2026-08-11T20:41:21.552958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.131001Z","title":"Spikformer: When spiking neural network meets transformer,","venue":null,"work_id":"debc060d-3515-480c-a2e5-537770c20028","year":2023},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.562208Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:7306af74830eb8719a74824125eb6c336ae9e7982f5c1d6cd1cf2b19493b1d7a","observation_id":"4f0bb142-1c41-4a8b-829e-7f5da7b0fb41","resolution":{"observed_at":"2026-08-11T20:41:22.137091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.107403Z","title":"Spiking transformers for event-based single object tracking,","venue":null,"work_id":"a406e433-2131-41c3-93c4-7200b57a3068","year":2022},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.566987Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:71afce4ecfeca515fe03ec7c73c504275a66d60621348c33e7d66f0c1bf2ad6b","observation_id":"d3faa5c3-17da-4d16-a6eb-cf0ed2d29e29","resolution":{"observed_at":"2026-08-11T20:41:22.113630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.088174Z","title":"Spikegpt: Generative pre-trained language model with spiking neural networks,","venue":null,"work_id":"1f080ace-6e0c-4573-aa6d-543db1f42499","year":2023},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.571540Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:9839f1733b9924658561f83cf90cea3de63aaff6e4a7b5ae22079cb3c12e2b82","observation_id":"c2a553b6-e50d-42ab-a6b9-3769f2de6c90","resolution":{"observed_at":"2026-08-11T20:41:22.093632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01694","last_updated":"2023-07-04T13:00:18Z","snapshot_observed_at":"2026-08-16T15:18:51.097476Z","submitted_at":"2023-07-04T13:00:18Z","title":"Spike-driven Transformer","version":1},"cited_work":{"arxiv_id":"2307.01694","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.01694","snapshot_observed_at":"2026-08-11T20:41:21.926168Z","title":"Spike-driven Transformer","venue":"cs.NE","work_id":"19b5aa3b-58b5-480c-b552-9157cb326b6a","year":2023},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.576255Z"},"links":{"cited_paper":"/paper/2307.01694","citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:0a9ea1a905084b34803f232cb0f951afb6075c0c03405552108ff8814a3df369","observation_id":"77e862d1-3657-45d9-b92b-356ddae6465d","resolution":{"observed_at":"2026-08-11T20:41:21.933526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.064729Z","title":"Reconfigurable dataflow optimization for spatiotem- poral spiking neural computation on systolic array accelerators,","venue":null,"work_id":"20d42bd4-d861-4788-bc44-3e0914595162","year":2020},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.582056Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:dfdee5d5be460883c049625c497f08941c59faed32ef85d3bc30d00373f45470","observation_id":"c7930d23-617e-46df-8b11-b783b97b05eb","resolution":{"observed_at":"2026-08-11T20:41:22.073022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.148794Z","title":"Parallel time batching: Systolic- array acceleration of sparse spiking neural computation,","venue":null,"work_id":"6efebe61-a7ca-466a-af52-c20bfaa813fb","year":2022},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.587299Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:f933e3e9e6ccd064d6059daf9cc2a2ffd598eecd934dfdeb57a31d452b5fe733","observation_id":"734d311b-43f5-47c4-97cb-0b1646618ea7","resolution":{"observed_at":"2026-08-11T20:41:22.153553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14073","last_updated":"2024-09-01T13:26:58Z","snapshot_observed_at":"2026-08-16T13:32:49.788308Z","submitted_at":"2024-07-19T07:02:26Z","title":"LoAS: Fully Temporal-Parallel Dataflow for Dual-Sparse Spiking Neural Networks","version":3},"cited_work":{"arxiv_id":"2407.14073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14073","snapshot_observed_at":"2026-08-11T20:41:21.902976Z","title":"LoAS: Fully Temporal-Parallel Dataflow for Dual-Sparse Spiking Neural Networks","venue":"cs.AR","work_id":"8a81619f-adb8-4857-b131-c7d60265778f","year":2024},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.592496Z"},"links":{"cited_paper":"/paper/2407.14073","citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:d2bfa8803e157ce0ea99b2fe9f919bb582f57bf2e7c1f8a33ecfdf6776955f5a","observation_id":"f117f8ed-ade5-48d3-86c0-bc289fc712bc","resolution":{"observed_at":"2026-08-11T20:41:21.910319Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.598783Z","title":"Spinalflow: An architecture and dataflow tailored for spiking neural networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.598783Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:f427d46dd1e6e32c39b5ae1244021347fc5ec70f7f0159135227eab37b9f52c9","observation_id":"0496b4a5-050a-4289-a350-2dc3a3a3c674","resolution":{"observed_at":"2026-08-11T20:41:21.598783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.604890Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.604890Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:a9867f11d5ca2110ae380ae6175faddda556930860d73193c0524bcd40ae5306","observation_id":"35c969a9-2f04-4a0a-a1b3-a4f7b879adf0","resolution":{"observed_at":"2026-08-11T20:41:21.604890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.029073Z","title":"3d-carbon: An analytical carbon modeling tool for 3d and 2.5 d integrated circuits,","venue":null,"work_id":"7fa2f31d-21a6-4001-b017-480e1e514fa4","year":2024},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.611982Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:4f10984eded3ee69ce0a6d55d72955e7bcc5d75b6ceca006e700451bd380a1ad","observation_id":"df4b7f45-241f-45f0-bb8d-3950f1efd3ad","resolution":{"observed_at":"2026-08-11T20:41:22.034996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:22.008315Z","title":"Nebula: A neuromorphic spin-based ultra-low power architecture for snns and anns,","venue":null,"work_id":"0d1c027f-2e1b-4f73-9e56-d7fa09bb65de","year":2020},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.616423Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:0d1516582f45dccd8cfe8351ad060a7c3caecc533ab4b315fa08dbc9de00e87e","observation_id":"7031a519-f29e-4358-94ba-36e100f94e80","resolution":{"observed_at":"2026-08-11T20:41:22.014632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.990270Z","title":"30.2 a 22nm 0.26 nw/synapse spike-driven spiking neural network processing unit using time-step-first dataflow and sparsity-adaptive in-memory computing,","venue":null,"work_id":"102c0c78-18ed-4a11-983a-ad991d6f8dba","year":2024},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.621426Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:b8688b556bd0da794bfa50979c9c6ae5371391a35cd089e3afeb7db94869b089","observation_id":"13cef4d3-103b-4b89-a464-67624381c2e9","resolution":{"observed_at":"2026-08-11T20:41:21.995628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.626932Z","title":"Design and architectural co-optimization of monolithic 3d liquid state machine-based neuromorphic processor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.626932Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:9abe4dbc7dc2826a425b171f44187b6c7897adc6bb113f9cfded6ff7770326ad","observation_id":"55057ff2-f72a-4ab2-99c3-d6b7bc894bb0","resolution":{"observed_at":"2026-08-11T20:41:21.626932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.974850Z","title":"Area-efficient and low-power face-to-face-bonded 3d liquid state machine design,","venue":null,"work_id":"97d5550b-8ae0-4e74-b2b4-3a771506f353","year":2018},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.631366Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:b803b8e4b2b2e57b50b74710a9176d13681b36d5577ce09135c46d55d6ee5fb4","observation_id":"20363ebb-9580-46ff-af03-082a1fca549a","resolution":{"observed_at":"2026-08-11T20:41:21.979842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.960584Z","title":"The cifar-10 dataset,","venue":null,"work_id":"6eb55625-9075-456f-90a1-fdc7867f1a2a","year":2014},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.636773Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:2218fe09d0fea800c08dbaeb3d63f8ddf802e2fda90ba03e57ad0b9c1e7a47cf","observation_id":"e1c9ebdf-6c5c-46f9-a8b0-d40daf0a8dc5","resolution":{"observed_at":"2026-08-11T20:41:21.965393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:41:21.642571Z","title":"Pin-3d: a physical synthesis and post-layout optimization flow for heterogeneous monolithic 3d ics,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:41:21.642571Z"},"links":{"citing_paper":"/paper/2412.05540"},"observation_digest":"sha256:d6031a2988955d80571307f4230bc5d90c34438ca843dee8a5640c6c56ac1180","observation_id":"c91688db-3921-4659-9f99-8ec3f1d6f87c","resolution":{"observed_at":"2026-08-11T20:41:21.642571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.05540","last_updated":"2024-12-07T05:15:05Z","latest_version":1,"primary_category":"cs.NE","snapshot_observed_at":"2026-08-17T13:53:37.824814Z","submitted_at":"2024-12-07T05:15:05Z","title":"Towards 3D Acceleration for low-power Mixture-of-Experts and Multi-Head Attention Spiking Transformers"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":2,"verified_fuzzy":16},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 2 inbound Pith citation observations for arXiv:2412.05540."}