{"as_of":"2026-08-16T04:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:67dc573e76fdb0534afa0e16c84769bd76e64ff30a4b5e31a9199f20a198780d","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:36:46.250318Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02364/citation-record","integrity":"/paper/2507.02364/integrity","json":"/paper/2507.02364/citation-record.json","paper":"/paper/2507.02364"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:51.467555Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding,","venue":null,"work_id":"5b86cdf1-63da-4bba-9030-85eee1b06510","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.182782Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:da72a05b23b2b35825d9fbb677fb2282c6b5c07d52c8ee125fef58e081a68383","observation_id":"528bf655-b90c-4e02-ae4d-54b15ee00b05","resolution":{"observed_at":"2026-08-06T20:36:51.642929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:51.193289Z","title":"Improving Language Understanding by Generative Pre-Training,","venue":null,"work_id":"b93bcb9f-e3a9-4d17-9851-8fef2abe1a84","year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.292122Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:4e5978221c098fa7eb247ebf37e1825356c8f2cc0aae24c7a1ba938721b1f9a6","observation_id":"4f160cb9-00ed-457f-8950-27e28a5f1b3b","resolution":{"observed_at":"2026-08-06T20:36:51.310952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.951085Z","title":"Attention is All You Need,","venue":null,"work_id":"b6a5acbe-b6b7-4be9-a955-4a9e09f2fb70","year":2017},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.401565Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:aa591a7f1dc3dcb2b971dad54f44c9e8811ef565bd249d52df90b509e844f3d1","observation_id":"958781e6-f138-4089-887e-48726cb51d96","resolution":{"observed_at":"2026-08-06T20:36:51.061094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.811151Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations,","venue":null,"work_id":"eb7c99aa-2067-4af9-8137-1bc41ff0923d","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.543988Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:df425915bc3345e01f0a62c9c0df885734210fde3f004d7f1f675307f94f5259","observation_id":"e6783fe1-78b3-4af7-ab5f-5771a3a58bbf","resolution":{"observed_at":"2026-08-06T20:36:50.882920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.647015Z","title":"Q-BERT: Hessian Based Ultra Low Precision Quan- tization of BERT,","venue":null,"work_id":"e58cbcf2-4183-46db-8c3a-4a1a4d0acf6a","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.671062Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:1e6451b883d44cde860a11f542420b55a3324ea6f2fc003ff61a119f1e3c67e3","observation_id":"fd1b8fc8-5505-4cfb-80f7-1279085b2f40","resolution":{"observed_at":"2026-08-06T20:36:50.735229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.525503Z","title":"DistilBERT, a Distilled Version of BERT: Smaller, Faster, Cheaper and Lighter,","venue":null,"work_id":"6609ecb5-3b4d-4368-b3f5-c6d795550515","year":null},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.809652Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:7fff0f31a67b232f4ad97c68724713328956664b53a4c9685c9e821b0f55c3ac","observation_id":"aa13fc0a-4b9f-4526-99da-16ad114c65f9","resolution":{"observed_at":"2026-08-06T20:36:50.609746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.400525Z","title":"Patient Knowledge Distillation for BERT Model Compression,","venue":null,"work_id":"c4d627c7-fde6-4d34-95d6-da1a968e3799","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.062501Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:14cf0da66b29e9187eaf716dbb4bf22c08a2ccd93dc647f9f5b7166083748391","observation_id":"34c71715-fa41-4b04-9cb1-3f4b3f4f0efa","resolution":{"observed_at":"2026-08-06T20:36:50.446369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.250194Z","title":"MiniLM: Deep Self-Attention Distillation for Task-Agnostic Compression of Pre-Trained Transformers,","venue":null,"work_id":"ed4a0477-1200-489c-bd75-92e056fde34c","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.183916Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:48fb51b30ca45ed95f70c763d5c250a72d1d5311ce236f68dec5d2f3970cdb9d","observation_id":"0e1deae1-a96a-42ee-b3c4-dce0a40d210d","resolution":{"observed_at":"2026-08-06T20:36:50.340957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T20:36:44.310787Z","title":"LoRA: Low-Rank Adaptation of Large Language Models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.310787Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:f7e49d0994e80f8a30425636f4415149fb99da309aedee33b15be8317007648b","observation_id":"92e4d209-8be5-4e16-8aa9-37d73a018f13","resolution":{"observed_at":"2026-08-06T20:36:44.310787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.107817Z","title":"Parameter-Efficient Transfer Learning for NLP,","venue":null,"work_id":"37709099-c7db-49ab-a470-8cfe91a0fa89","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.435987Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:989050dfcf2ecf42fa6fcbcc61d470b1163df82f311a9527396d4427b5482f37","observation_id":"ef3919a1-d378-48e7-b722-693e948ecb00","resolution":{"observed_at":"2026-08-06T20:36:50.193791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.958639Z","title":"A Variational Eigenvalue Solver on a Photonic Quantum Processor,","venue":null,"work_id":"5dae6358-53d9-4beb-9cdf-b098442baf76","year":2014},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.561514Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:81074593cf8f17edd6c88aa65284a7fc6d740962395dc57805c1930b1f2a837f","observation_id":"06493a5e-1b0d-450b-8f4b-c03744043b78","resolution":{"observed_at":"2026-08-06T20:36:50.032201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.839610Z","title":"Quantum Self-Attention Neural Networks for Text Classification,","venue":null,"work_id":"44594a98-c0f4-4dff-afc7-740976d0597a","year":2024},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.638580Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:48e08310e9d5270a81767d991cf88c1519f902f117fa6df6a741a0e5365f668c","observation_id":"f4cfb8b4-1357-4fdd-8c2d-71e4cc7615b8","resolution":{"observed_at":"2026-08-06T20:36:49.877280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:44.699678Z","title":"Quantum Vision Transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.699678Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:e88ecd298e67b5daf9176ed7e709238eaaec3293f887032993c3a10bf171277f","observation_id":"9a7f843c-3a56-4f7b-87bb-ebaa3afa7257","resolution":{"observed_at":"2026-08-06T20:36:44.699678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.691129Z","title":"Quantum Computing with Qiskit,","venue":null,"work_id":"79050321-008b-41ab-8d34-c7ea545d9dd0","year":null},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.777681Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:5918ff69fad8415b7ade91b4cd612cb2f9aaa90fd612362c97134c1944d0f80f","observation_id":"948f5b19-9feb-4a43-8a99-10131c07788b","resolution":{"observed_at":"2026-08-06T20:36:49.749108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.525890Z","title":"PyTorch: An Imperative Style, High- Performance Deep Learning Library,","venue":null,"work_id":"8bbf042a-e013-413d-9f3a-48bd92f5b4f7","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.952038Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:14f3b670989881aebd3416f950d479804478f146109b0c08d76078d27c381e47","observation_id":"e1a472c4-344f-4beb-a891-a2e0f5ff9457","resolution":{"observed_at":"2026-08-06T20:36:49.599691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.376055Z","title":"Quantum Computing in the NISQ Era and Beyond,","venue":null,"work_id":"3d43b969-f938-4af0-b772-c06fcf941ea4","year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.046415Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:29056fb4d9c90548ac01580f1fb346043bd991e7d2282be1a47082341f054f58","observation_id":"9b6ae8b5-9001-4e7b-b4ba-dfbe7b7c34ef","resolution":{"observed_at":"2026-08-06T20:36:49.457641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.153900Z","title":"MobileBERT: a Compact Task-Agnostic BERT for Resource-Limited Devices,","venue":null,"work_id":"7ac50e74-4357-400b-846e-d355c0a986be","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.109753Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:7f8bb5b4076e45a510241abe2f154c4534d15990743ebeac1d17b39007d6c41e","observation_id":"c90040c0-c9fb-46ce-acdb-f7f1f2b65ba0","resolution":{"observed_at":"2026-08-06T20:36:49.233491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.982679Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding,","venue":null,"work_id":"7456045f-eb5c-4a7d-a9ba-e77e509a5a50","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.188487Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:f20cf15438ba697324804ceb044b7ea6e5b7400cf674a0cc67ba2f3b1e48279b","observation_id":"85aadf26-5214-4c2a-b112-532feaf9e1a6","resolution":{"observed_at":"2026-08-06T20:36:49.066402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.790214Z","title":"Supervised Learning with Quantum- enhanced Feature Spaces,","venue":null,"work_id":"3ff13d58-5e34-481e-88d7-f222762c2a06","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.242937Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:76c371bce672d49740ee1b3ad218bc336f4fd77912075723138623e3a3fef027","observation_id":"e1110df6-8703-4185-8f11-d6e8d8292ddf","resolution":{"observed_at":"2026-08-06T20:36:48.870150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06002","last_updated":"2018-08-30T20:23:02Z","snapshot_observed_at":"2026-08-14T19:45:10.953329Z","submitted_at":"2018-02-16T16:09:34Z","title":"Classification with Quantum Neural Networks on Near Term Processors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06002","snapshot_observed_at":"2026-08-06T20:36:45.286794Z","title":"Classification with Quantum Neural Networks on Near Term Processors,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.286794Z"},"links":{"cited_paper":"/paper/1802.06002","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:2439cf064a4ebf02dcd9dd24eeaeeb945fafe1e10b43e09a3e00c397d2cc82a0","observation_id":"678d4324-a866-449f-bea6-2ef7d7359d09","resolution":{"observed_at":"2026-08-06T20:36:45.286794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.553539Z","title":"Quanvolutional Neural Networks: Powering Image Recognition with Quantum Circuits,","venue":null,"work_id":"e041da59-c6ee-43a4-bfc9-43a01bf0ba14","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.344647Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:14d431a38359f704248112c918643301cc5203ee65fe6b59f5933a057886e2f5","observation_id":"bdbde046-40e8-4aee-9ace-cea59b5326c7","resolution":{"observed_at":"2026-08-06T20:36:48.624041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.03755","last_updated":"2020-12-07T14:49:33Z","snapshot_observed_at":"2026-08-10T18:51:24.235176Z","submitted_at":"2020-12-07T14:49:33Z","title":"Foundations for Near-Term Quantum Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.03755","snapshot_observed_at":"2026-08-06T20:36:45.375653Z","title":"Foundations for Near-Term Quantum Natural Language Processing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.375653Z"},"links":{"cited_paper":"/paper/2012.03755","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:fa905b71485d72a165cf71b7a1096eb8a8332b58bb975050e7fc395c84003867","observation_id":"057dcb9b-8b08-4834-b1c1-e117b3e2f4dc","resolution":{"observed_at":"2026-08-06T20:36:45.375653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.376558Z","title":"The Dawn of Quantum Natural Language Processing,","venue":null,"work_id":"026702a3-5ae8-4a6a-a796-a4fbbf169f50","year":2022},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.467188Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:5df688e3f71f06872c4be5f404bfed93eff3b851d41a53ebb7ed92aac859fd57","observation_id":"70f0e1e9-d2be-46da-8d90-627d33d660c5","resolution":{"observed_at":"2026-08-06T20:36:48.479911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.221861Z","title":"Cost Function Dependent Barren Plateaus in Shallow Parametrized Quantum Circuits,","venue":null,"work_id":"e5468b70-b2e2-406d-b858-f86a7a7533d4","year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.561062Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:d93c3ead28f00213d320962c4c4c8514d843e67258754b2522db91fcc7d1f09d","observation_id":"0b3a4898-ade5-40a4-9849-7df8f9e68882","resolution":{"observed_at":"2026-08-06T20:36:48.280009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.963582Z","title":"Absence of Barren Plateaus in Quantum Convolutional Neural Networks,","venue":null,"work_id":"5fa24ec4-55dc-4610-925b-95da1b0260ce","year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.612769Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:fced691ddda294f84d75b699bea1033e42f4aedbbabf62241cbc2b1917e52b38","observation_id":"27590df4-685e-4efd-afa7-a5ea59e143ac","resolution":{"observed_at":"2026-08-06T20:36:48.102139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.742995Z","title":"Recursive Deep Models for Semantic Compositionality Over a Sentiment Treebank,","venue":null,"work_id":"ec5bba0e-c3bb-4bb6-b406-06c8d5d87a6d","year":2013},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.648112Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:1b60699cb13dc0b31eb33de74ff5a3020a3164312e72ebf8fd27cb21bc0d7081","observation_id":"be257a53-c18a-4060-9156-35a0b5cd3973","resolution":{"observed_at":"2026-08-06T20:36:47.867875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.509798Z","title":"DBpedia-Entity V2: A Test Collection for Entity Search,","venue":null,"work_id":"77c93636-55e5-4fe1-a02f-f0358d6ae5dd","year":2017},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.699472Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:a2abe7820e27b275d45d136bb99a2570c3e8f027a0355cd2c0d9ecda5ffbd9be","observation_id":"343d9f91-8f88-4a3f-9350-8b0c8bc1db61","resolution":{"observed_at":"2026-08-06T20:36:47.665509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07316","last_updated":"2023-03-19T13:37:01Z","snapshot_observed_at":"2026-08-14T05:00:07.792972Z","submitted_at":"2022-10-13T19:42:08Z","title":"MTEB: Massive Text Embedding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07316","snapshot_observed_at":"2026-08-06T20:36:45.741141Z","title":"MTEB: Massive Text Embedding Benchmark,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.741141Z"},"links":{"cited_paper":"/paper/2210.07316","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:3e1a50a1cbe666e379cb2c19fb470ffe9f11d87ba0bc2083ee96522a179b9ccd","observation_id":"4b032687-7e12-42f5-aa60-6fc2f7f1174d","resolution":{"observed_at":"2026-08-06T20:36:45.741141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08962","last_updated":"2019-09-25T22:55:20Z","snapshot_observed_at":"2026-08-14T21:38:13.014467Z","submitted_at":"2019-08-23T18:02:05Z","title":"Well-Read Students Learn Better: On the Importance of Pre-training Compact Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08962","snapshot_observed_at":"2026-08-06T20:36:45.789946Z","title":"Well-Read Students Learn Better: The Impact of Student Initialization on Knowledge Distillation,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.789946Z"},"links":{"cited_paper":"/paper/1908.08962","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:0710822bb7512192368858e410b304f0cb63ef5687cc168715cad8bec1287e43","observation_id":"2275fc31-732d-48c8-8c54-46dc8e0b0da4","resolution":{"observed_at":"2026-08-06T20:36:45.789946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.315627Z","title":"Generalization in NLI: Ways (Not) To Go Beyond Simple Heuristics,","venue":null,"work_id":"42b2351d-42bd-4c6b-9319-b63e62ff3f94","year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.893080Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:dca8ee2a28f45fccfcf9748a3ed1c97871f720e40f26140d1f92819149d64bb0","observation_id":"1debd108-568f-426f-a84c-8fe4d9ad088e","resolution":{"observed_at":"2026-08-06T20:36:47.411669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.135043Z","title":"Transformers: State- of-the-Art Natural Language Processing,","venue":null,"work_id":"aa16e524-ab37-4268-ba49-9f1a6730e734","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.997529Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:afbacf64bca7c6b67d6f145283e39f3dc497b566f08647771f055e9e265ce0a1","observation_id":"e2aef60b-0553-4fb3-8aad-e9a7e97cb8f9","resolution":{"observed_at":"2026-08-06T20:36:47.217751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.906810Z","title":"Expressibility and Entangling Capability of Parameterized Quantum Circuits for Hy- brid Quantum-Classical Algorithms,","venue":null,"work_id":"24cfb6ab-53e9-4413-a08e-7e6a661ec23d","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.066654Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:aa816968136ad905717e4c120076f422e870f68c50e09bbc3d4663e37fc3aee8","observation_id":"027b3bbe-ce98-4a42-97b2-01615bf988f9","resolution":{"observed_at":"2026-08-06T20:36:47.005156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.764605Z","title":"Barren Plateaus in Quantum Neural Network Training Landscapes,","venue":null,"work_id":"72322189-6b74-430d-b5a2-a3e3b981af61","year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.131673Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:3379fe8bafa55e967e06f57289fcd2beb15c175e1cfa39f7d60b4aa067179e7c","observation_id":"c59ea58f-ac8e-4653-9853-88a2d8dccfdb","resolution":{"observed_at":"2026-08-06T20:36:46.802689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.629580Z","title":"An Initializa- tion Strategy for Addressing Barren Plateaus in Parametrized Quantum Circuits,","venue":null,"work_id":"8522edee-684a-4e8c-a4af-7a4df5caf867","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.197571Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:9d36d5724854fd8a9bc299cb9d798a6beaeec31bc339901c8e1144c03d1cb322","observation_id":"e7c51b2f-0d97-4fbf-812f-5465c3f5a13c","resolution":{"observed_at":"2026-08-06T20:36:46.675709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.447953Z","title":"cuQuantum SDK: A High-Performance Library for Accelerating Quantum Science,","venue":null,"work_id":"b0a1931e-fd00-495f-9abd-c8639731a827","year":2023},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.250318Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:e8f8545e0cea69f7a861403971a0fdc9d02dd614846ec76ce0e4fff2cd3d4fe7","observation_id":"5b0c8982-e16d-4e24-ab1f-10c8a2949970","resolution":{"observed_at":"2026-08-06T20:36:46.528651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-06T20:36:43.932706Z","title":"Available: https://arxiv.org/abs/1910.01108","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.932706Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:6020c4735d47cf42766cb736b92835fb39c0df70374e4309e6cf40fe035b166e","observation_id":"48682448-2915-4465-918f-ea75a90f3168","resolution":{"observed_at":"2026-08-06T20:36:43.932706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08810","last_updated":"2024-06-19T01:39:44Z","snapshot_observed_at":"2026-08-15T00:52:11.520317Z","submitted_at":"2024-05-14T17:55:32Z","title":"Quantum computing with Qiskit","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08810","snapshot_observed_at":"2026-08-06T20:36:44.834762Z","title":"Available: https://arxiv.org/abs/2405.08810","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.834762Z"},"links":{"cited_paper":"/paper/2405.08810","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:46e00d9cf2b32ffbaef27fb302e8605f6dac985af8575fdfd2b71df5984eac3f","observation_id":"71f625f6-2591-4515-a751-81f927bf9537","resolution":{"observed_at":"2026-08-06T20:36:44.834762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T14:48:35.741904Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2507.02364."}