{"as_of":"2026-08-11T09:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d32d24819e30de0a2301648d31e0dddac846078da49edc2d96278499f6d71bf","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:07:07.451001Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T11:31:25.851340Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T01:46:26.885322Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"cited_work":{"arxiv_id":"2501.15674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15674","snapshot_observed_at":"2026-07-02T01:46:26.885322Z","title":"Tensorllm: Tensorising multi-head attention for enhanced reasoning and compression in llms","venue":null,"work_id":"edf00b95-921a-4090-b1f4-3e308a9c43f7","year":2025},"citing_paper":{"arxiv_id":"2509.03234","last_updated":"2026-04-14T16:44:27Z","snapshot_observed_at":"2026-07-06T22:22:50.835674Z","submitted_at":"2025-09-03T11:46:24Z","title":"TeRA: Vector-based Random Tensor Network for High-Rank Adaptation of Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-18T19:18:00.602479Z"},"links":{"cited_paper":"/paper/2501.15674","citing_paper":"/paper/2509.03234"},"observation_digest":"sha256:43a7204d824870acd2be7066381692c80cf24fbd0c5f7687bbc66fc6dba66d4a","observation_id":"ddd712a5-dc44-4b1e-87d5-089ab75db9d2","resolution":{"observed_at":"2026-05-18T19:22:49.187866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"cited_work":{"arxiv_id":"2501.15674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15674","snapshot_observed_at":"2026-07-02T01:46:26.885322Z","title":"Tensorllm: Tensorising multi-head attention for enhanced reasoning and compression in llms","venue":null,"work_id":"edf00b95-921a-4090-b1f4-3e308a9c43f7","year":2025},"citing_paper":{"arxiv_id":"2606.03465","last_updated":"2026-06-02T10:45:21Z","snapshot_observed_at":"2026-08-07T07:12:01.249170Z","submitted_at":"2026-06-02T10:45:21Z","title":"Rethinking the Role of Tensor Decompositions in Post-Training LLM Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T11:31:25.851340Z"},"links":{"cited_paper":"/paper/2501.15674","citing_paper":"/paper/2606.03465"},"observation_digest":"sha256:fbf6b25e8bda150f4a6b0f2242968b9073106b8b9611c370fba1c6169a33c9e4","observation_id":"b25fc94b-297d-4963-8ae3-9ce3a1001ff3","resolution":{"observed_at":"2026-07-02T01:46:26.887416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15674/citation-record","integrity":"/paper/2501.15674/integrity","json":"/paper/2501.15674/citation-record.json","paper":"/paper/2501.15674"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:08.102555Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":"5a9a286d-e11f-49fc-84c5-cd5ba3b18e8f","year":1901},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.260858Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:a9978d96d3260f08343d565ea70bfb3d14f5603a43abc78b65b6d129be7e8a7f","observation_id":"6f26a2ab-c321-4217-95cf-d7bbc1c530f1","resolution":{"observed_at":"2026-08-10T14:07:08.108504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T14:07:07.266744Z","title":"GPT-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.266744Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:ff37f7eb7647f9581a42f890d04fb8ac8916cd82dc68828f314be44526cb1222","observation_id":"86e01de0-52c9-4a5b-a4bd-9a9b3a8d798a","resolution":{"observed_at":"2026-08-10T14:07:07.266744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T14:07:07.273125Z","title":"LLaMA: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.273125Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:fd384422410e84d56ff115d728d1df8f94f49b8fc376b5d9581b7423da47022b","observation_id":"f3b77fc1-ab82-49e7-9235-246452156337","resolution":{"observed_at":"2026-08-10T14:07:07.273125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T14:07:07.278719Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.278719Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:8cf7822373db1e0f4bbb31f8c2fcc48936cb10e5e7e5d668a7fbd4a530092e4b","observation_id":"10d14ccd-6a7a-445c-b886-a8e0c95dc248","resolution":{"observed_at":"2026-08-10T14:07:07.278719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T14:07:07.283924Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.283924Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:5225fdc4bb4ee56223913afd4a954d4652a7385292c8274b3e68367ccbe46af8","observation_id":"7863bf16-b564-42da-9219-a8d3b5d64c64","resolution":{"observed_at":"2026-08-10T14:07:07.283924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:08.083893Z","title":"Learning Deep Transformer Models for Machine Translation,","venue":null,"work_id":"5988f353-f4c0-4ba1-abb2-8633fa0496d3","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.288835Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:ced3bb13682c41ecc87f9932799f31c2fb923be990f0193f1cf0e1511ced48f7","observation_id":"40579ccb-2f30-4755-8d62-d2d237e59e08","resolution":{"observed_at":"2026-08-10T14:07:08.089330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:08.065706Z","title":"Language Modeling with Deep Transformers,","venue":null,"work_id":"dbd89be9-b47d-4b9a-bd50-d8d52caf7de3","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.294202Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:4e70197f0ea1a609b92bb86c6ddaeffe72562528f8b2e32f43e8c3f909b918c0","observation_id":"d23f7f88-006b-4299-823f-c750177c7ec3","resolution":{"observed_at":"2026-08-10T14:07:08.071857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:08.047539Z","title":"Text Summarization with Pretrained Encoders,","venue":null,"work_id":"45767c8d-a912-4c1b-ac96-a2e76330c394","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.298845Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:86f98e502463ce181084ecdb188f5718be75743e1d8f49d2e1f3ed37893e801b","observation_id":"d0e57dfd-dd37-4ce8-aa2b-0c572cecdd85","resolution":{"observed_at":"2026-08-10T14:07:08.052881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-10T14:07:07.303172Z","title":"Distilling the Knowledge in a Neural Network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.303172Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:68aa7e1606be29c627bd358c2ab6d87bdd7ab5cc83890db0d55a19d6be539fd6","observation_id":"9231fbed-cae4-432e-b93b-86a80de752d4","resolution":{"observed_at":"2026-08-10T14:07:07.303172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:08.029398Z","title":"On the effect of dropping layers of pre-trained transformer models,","venue":null,"work_id":"0e15beb8-120d-4a25-b126-67f3eeac037e","year":2023},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.307866Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:a46286cff4ce8c6809edc1d4fb11fddd55c757815867d7cd0af9bbd29ea99b23","observation_id":"84d83b32-0695-41e0-b9b5-1b32340de807","resolution":{"observed_at":"2026-08-10T14:07:08.035620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:08.009391Z","title":"Reducing Transformer Depth on Demand with Structured Dropout,","venue":null,"work_id":"1edeab32-2f91-47b6-9f26-f6ca9e1fbb3e","year":2020},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.312480Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:349f3abbab7fb616fafd039f33043e58667d727c8b18333b52a3352974473615","observation_id":"756c026f-59bd-4788-ab57-1636106d641f","resolution":{"observed_at":"2026-08-10T14:07:08.015303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.991967Z","title":"The Truth is in There: Improving Reasoning in Language Models with Layer-Selective Rank Reduction,","venue":null,"work_id":"693d5f17-66a1-4b6a-b8fe-bcdddd4c1aad","year":2024},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.316894Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:0fd8d36765b1c399ed3455d11fe891a7f08a66d7e55360a6e84b4054eb799a97","observation_id":"9642d94c-66e3-43bf-8b4b-518111f8e3d8","resolution":{"observed_at":"2026-08-10T14:07:07.997332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.973726Z","title":"Com- pressing Large Language Models using Low Rank and Low Precision Decomposition,","venue":null,"work_id":"f1dd432e-44da-4319-bd40-6c48cf29feff","year":2024},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.321399Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:13c2fed8c2085a3cf4d19bc0458974a46144727477f583ff5d19226b1b6c01c0","observation_id":"4c459796-10f9-4258-8ace-c42cc817e4bd","resolution":{"observed_at":"2026-08-10T14:07:07.980328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.06133","last_updated":"2020-01-06T10:41:42Z","snapshot_observed_at":"2026-08-10T17:50:11.805076Z","submitted_at":"2019-03-14T17:19:38Z","title":"Compression and Interpretability of Deep Neural Networks via Tucker Tensor Layer: From First Principles to Tensor Valued Back-Propagation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.06133","snapshot_observed_at":"2026-08-10T14:07:07.325911Z","title":"Com- pression and Interpretability of Deep Neural Networks Via Tucker Ten- sor Layer: From First Principles to Tensor Valued Back-Propagation,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.325911Z"},"links":{"cited_paper":"/paper/1903.06133","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:9c090297d7df439f46ba77be61ee06d56fdc75d5a73ecf3f14a583b9f11cb29e","observation_id":"8d405240-c8c7-408c-90e5-52602eb0eef6","resolution":{"observed_at":"2026-08-10T14:07:07.325911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00526","last_updated":"2024-10-03T23:28:27Z","snapshot_observed_at":"2026-08-07T09:30:39.446831Z","submitted_at":"2023-07-02T09:33:09Z","title":"TensorGPT: Efficient Compression of Large Language Models based on Tensor-Train Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00526","snapshot_observed_at":"2026-08-10T14:07:07.331103Z","title":"TensorGPT: Efficient compression of the embedding layer in LLMs based on the tensor-train decomposi- tion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.331103Z"},"links":{"cited_paper":"/paper/2307.00526","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:ea09bd703f7f1916be7abdbe3414b18ceaf4a296a6661a7e22f6c2140044b1fd","observation_id":"dcf166f9-4fe9-4dda-b9fc-7c39aab37575","resolution":{"observed_at":"2026-08-10T14:07:07.331103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17261","last_updated":"2025-02-18T03:42:48Z","snapshot_observed_at":"2026-08-11T03:37:53.239155Z","submitted_at":"2024-06-25T04:01:32Z","title":"TRAWL: Tensor Reduced and Approximated Weights for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17261","snapshot_observed_at":"2026-08-10T14:07:07.336593Z","title":"TRAWL: Tensor Reduced and Approximated Weights for Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.336593Z"},"links":{"cited_paper":"/paper/2406.17261","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:47f247eddd3696a12a9bcee0770aaaa12e59cf9da775112dac8e288640511393","observation_id":"77baf5c0-dce4-47ef-8883-8a860bb8dc5a","resolution":{"observed_at":"2026-08-10T14:07:07.336593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.951724Z","title":"What does BERT look at? an analysis of BERT’s attention,","venue":null,"work_id":"7fcded07-7808-4c1a-91f8-949812999469","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.342225Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:ec22910479034043dfffd61372093658d766063f3ca750b72751f66715dfbdc4","observation_id":"c9bc9e3b-076e-4ebb-9cc8-e360cfd15dc1","resolution":{"observed_at":"2026-08-10T14:07:07.958434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.931793Z","title":"A Multiscale Visualization of Attention in the Transformer Model,","venue":null,"work_id":"51a915a4-dd44-4291-bbf8-ef7d73feba8d","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.347520Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:da4f39528f58e35b31b16d74fd034e435cb8831b00c5f87de2f682e087008985","observation_id":"15b74fe5-059b-4438-ba5a-bd2759cc446a","resolution":{"observed_at":"2026-08-10T14:07:07.937955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.915479Z","title":"Analyzing the Structure of Attention in a Transformer Language Model,","venue":null,"work_id":"4cf8d44a-609c-497f-af3a-d816219db15a","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.352866Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:035cc5a370532e55afc753fa0dfe7e5b5c17a003a92a6cb45a48b3c4d897488e","observation_id":"13c5ec7a-c579-4218-80d6-3bc8f9f4d95d","resolution":{"observed_at":"2026-08-10T14:07:07.920506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.363311Z","title":"A practical introduction to tensor networks: Matrix product states and projected entangled pair states,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.363311Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:c1acfd1d77f3b446d1a0d33767e8d8503f139da3906683f8b76be5b835304e18","observation_id":"ba73dd08-8299-424b-9cbb-77e0866087d4","resolution":{"observed_at":"2026-08-10T14:07:07.363311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.886550Z","title":"Tensor decompositions for signal processing applica- tions: From two-way to multiway component analysis,","venue":null,"work_id":"78eff56e-0737-4f61-b646-9df0e1983077","year":2015},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.368032Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:36c1b1a6c6c4777d27fd56fd0bdd4a31b0e5df089bee88c1cb4a07783bad9faf","observation_id":"3b5cdbcd-dc26-4215-8769-354f10a3e13e","resolution":{"observed_at":"2026-08-10T14:07:07.891797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.372747Z","title":"Tensor decompositions and applications,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.372747Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:f87df2e7353db6a511504625200a5408208aada033341694da86f86b08f592c2","observation_id":"f18c04d2-7c5f-493c-9fce-e37d6f28d415","resolution":{"observed_at":"2026-08-10T14:07:07.372747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.377497Z","title":"Some mathematical notes on three-mode factor analysis,","venue":null,"work_id":null,"year":1966},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.377497Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:0e83ab538f167a430d54897977ee61ab43201fdc96933c40d53cce952835e502","observation_id":"1a10ffc4-c6eb-4a1a-9b8e-a9627aafa54e","resolution":{"observed_at":"2026-08-10T14:07:07.377497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.382586Z","title":"A multilinear singular value decomposition,","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.382586Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:793a8493bd29f4286a31eb4f97951b886a92abf309eac1349b98c43fc550e12a","observation_id":"9083586a-8513-4a2c-a994-1b17293d4196","resolution":{"observed_at":"2026-08-10T14:07:07.382586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.830513Z","title":"Multilinear analysis of image ensembles: Tensorfaces,","venue":null,"work_id":"92eab1ec-846f-4dc3-a8d0-3d20b26df091","year":2002},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.386751Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:3ef1a98dde5e188ef355e8ed8629126c2c731d973ceae9606dcf947e55c258fa","observation_id":"b3e7d759-dd1e-4902-a784-1da32a97b4d5","resolution":{"observed_at":"2026-08-10T14:07:07.836271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10728","last_updated":"2024-10-14T17:09:14Z","snapshot_observed_at":"2026-08-07T18:19:42.184679Z","submitted_at":"2024-10-14T17:09:14Z","title":"Towards LLM-guided Efficient and Interpretable Multi-linear Tensor Network Rank Selection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10728","snapshot_observed_at":"2026-08-10T14:07:07.391120Z","title":"Towards LLM-guided Efficient and Interpretable Multi-linear Tensor Network Rank Selection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.391120Z"},"links":{"cited_paper":"/paper/2410.10728","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:1e9b53a1fdff42c73b6ea11113de20d08965c05c585f9dd94c3cffaa04680771","observation_id":"aec892dc-ee6e-462f-8513-de6983d514c6","resolution":{"observed_at":"2026-08-10T14:07:07.391120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.813588Z","title":"SVDinsTN: A Tensor Network Paradigm for Efficient Structure Search from Regularized Modeling Perspective,","venue":null,"work_id":"6991e8b7-18e4-4229-a47a-096758a8978b","year":2024},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.396137Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:bb459cfea642d1d8e895ac9603606933016b12d04ec9c490a42d6678a945fe9b","observation_id":"119d1f5c-92a4-431b-aa1f-99f346184eec","resolution":{"observed_at":"2026-08-10T14:07:07.819147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.401783Z","title":"Attention is All you Need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.401783Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:6445c9ec226f1b127dabe7940aefda78c18052d068a608993ca9ee7f87332d0e","observation_id":"8628c19c-f739-450f-b528-d9b0c8439800","resolution":{"observed_at":"2026-08-10T14:07:07.401783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.407248Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.407248Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:a29afbdadd5998c2ae68803756c16480b3c1018d97cbdbfcb6ab1d4e3f228dc7","observation_id":"42fab33e-fe8e-43ee-ad9d-a04bae24bc05","resolution":{"observed_at":"2026-08-10T14:07:07.407248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.774494Z","title":"TensorLy: Tensor Learning in Python,","venue":null,"work_id":"f9aeeaed-97e5-4cd7-aed6-6a903fb4b562","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.412904Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:89727363edb4cb9ba0967c53af3ae3b96afec92cb0e9beee81d80dc8f1ec5524","observation_id":"bc0b5f13-36e9-4c92-907b-669e1939645e","resolution":{"observed_at":"2026-08-10T14:07:07.779432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.756390Z","title":"On the best rank-1 and rank-( r1, r2, ..., rn) approximation of higher-order tensors,","venue":null,"work_id":"49eee5f1-e4fe-4dab-a0f1-f7d59271e22e","year":2000},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.418281Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:8a61099c854e6acc6a9379f17b74957eb6cd7251e36d81b3afba3908fe2b676c","observation_id":"efa60943-eec0-4246-bea4-eb2584de0a6b","resolution":{"observed_at":"2026-08-10T14:07:07.762649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-10T14:07:07.423330Z","title":"RoBERTa: A robustly optimized BERT pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.423330Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:aa6624fbbaeb513f72d6dbd95fb5d06fdae1fe852705ac075816d4224b43c502","observation_id":"e239638c-02d1-4d08-8240-3d8eae6afe80","resolution":{"observed_at":"2026-08-10T14:07:07.423330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.739059Z","title":"GPT-J-6B: A 6 Billion Param- eter Autoregressive Language Model","venue":null,"work_id":"f398a5f7-84c4-44d7-80af-b6001fb9bcff","year":2021},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.429022Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:fa6af0a312ad24dffdfd48d8a9c91b4a498f0b0bda9509658d09271743506ddd","observation_id":"8b8eae6a-e187-4a45-8158-e78dfd762381","resolution":{"observed_at":"2026-08-10T14:07:07.744086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.721209Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi- hop Question Answering,","venue":null,"work_id":"adb7987b-6e2d-4ab1-bc93-20e2f0f4dc7c","year":2018},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.434817Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:870e889873e856515fbb5fa756c1c52c775afaf4cc529699752ecbaa1a7b70f2","observation_id":"e75c930d-6c3e-4154-bde2-75eeba23ccef","resolution":{"observed_at":"2026-08-10T14:07:07.726790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.702601Z","title":"FEVER: a Large-scale Dataset for Fact Extraction and VERification,","venue":null,"work_id":"a378077e-0ea8-4949-a7aa-3f392eeb1b27","year":2018},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.439610Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:c39b2c8dee46969ea5bef8ddcfc8ee939ad1536fa6ea3e567bb3cc60b921da4b","observation_id":"2555d44a-11f4-4e0a-8a3e-ebe51e7464d2","resolution":{"observed_at":"2026-08-10T14:07:07.708294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.685913Z","title":"Bias in bios: A case study of semantic representation bias in a high-stakes setting,","venue":null,"work_id":"4f218ce8-8ef0-45c7-b08a-2538f9d08977","year":2019},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.445332Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:ecda6501c603ad6c7c4f4319c5ea1d005aa2fcd809a36582599566af69fa883a","observation_id":"d0295f6c-284c-4fc1-bce0-fb1886ddbbaa","resolution":{"observed_at":"2026-08-10T14:07:07.691237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:07:07.667048Z","title":"A large an- notated corpus for learning natural language inference,","venue":null,"work_id":"ccbaf75b-6961-42af-a76c-dd3bd0971e18","year":2015},"citing_paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T14:07:07.451001Z"},"links":{"citing_paper":"/paper/2501.15674"},"observation_digest":"sha256:ede30077853e02bacbf4336bc289873adb33d65a02e7433ea8307368c345e536","observation_id":"cdbb0aac-7c01-4b54-80da-2d5959792193","resolution":{"observed_at":"2026-08-10T14:07:07.674060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.15674","last_updated":"2025-05-15T12:42:44Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T08:29:10.028817Z","submitted_at":"2025-01-26T21:05:16Z","title":"TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 2 inbound Pith citation observations for arXiv:2501.15674."}