{"as_of":"2026-08-14T18:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dd221710e5cad2287fc674fd40c05f594e6b5e5a64046a1dfc9c5144388fd831","coverage":[{"denominator":299,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:41:16.681006Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.03220/citation-record","integrity":"/paper/2412.03220/integrity","json":"/paper/2412.03220/citation-record.json","paper":"/paper/2412.03220"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.654804Z","title":"V aswani, N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.654804Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:fc0c504edc01bde78517087d4f3393a811fe5e7fafd32f578984178f30da69c6","observation_id":"82611677-ae5e-436f-b1aa-438dcd5f982e","resolution":{"observed_at":"2026-08-11T22:41:12.654804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.704741Z","title":"Radford, K","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.704741Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:ec9891454a3e3fc57559184f5613b5b2721ae1a8cb1cf8e8bb2721719eda9a58","observation_id":"43ea0d31-a3b9-4072-9b65-deae0d35c044","resolution":{"observed_at":"2026-08-11T22:41:12.704741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T22:41:12.751882Z","title":"Devlin, M.-W","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.751882Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b19cff1d357dec55675216abc20d0b1add16e0fc9e3216b1325ea1602286a279","observation_id":"b2d2ff06-58c2-4f13-8497-59922c64ba4b","resolution":{"observed_at":"2026-08-11T22:41:12.751882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-08-13T19:33:55.174854Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-08-11T22:41:12.804749Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.804749Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5beb8cbadfe44684d69b238cfbc304ffa249d1839068f7a1a91260d089dd6785","observation_id":"ea10a133-79cb-49cf-87d7-a5a2c1a4f68a","resolution":{"observed_at":"2026-08-11T22:41:12.804749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10845","last_updated":"2023-03-20T03:39:27Z","snapshot_observed_at":"2026-08-13T12:21:03.696747Z","submitted_at":"2023-03-20T03:39:27Z","title":"PanGu-{\\Sigma}: Towards Trillion Parameter Language Model with Sparse Heterogeneous Computing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10845","snapshot_observed_at":"2026-08-11T22:41:12.844818Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.844818Z"},"links":{"cited_paper":"/paper/2303.10845","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:93660a97fd702494fddd46539309b7436647e3ca6c154b263440fbce7ffc1863","observation_id":"785180cf-d561-41d9-a1dd-051adb4e1950","resolution":{"observed_at":"2026-08-11T22:41:12.844818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.894756Z","title":"Graves and A","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.894756Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:cc04e9f6acfc88be33eeb7ab0e6852ab8fd1fe5bc44abfa72de2d36d70016aea","observation_id":"45a56854-f1ee-4663-9cd4-9fe50f49e244","resolution":{"observed_at":"2026-08-11T22:41:12.894756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.954749Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.954749Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:232df183c9ef1bd38a64df8b92e0b4164b03c9fcf36312f37bdcb46e5918b6ea","observation_id":"beec97a6-b5b1-4251-8163-1b42705b0516","resolution":{"observed_at":"2026-08-11T22:41:12.954749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07129","last_updated":"2019-06-04T11:35:58Z","snapshot_observed_at":"2026-08-14T16:30:49.690052Z","submitted_at":"2019-05-17T06:24:16Z","title":"ERNIE: Enhanced Language Representation with Informative Entities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07129","snapshot_observed_at":"2026-08-11T22:41:12.984953Z","title":"Zhang, X","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.984953Z"},"links":{"cited_paper":"/paper/1905.07129","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:7d81cce39543783e3ebb24cc3d331d929ed542b697f9c656578a4f982b4e957d","observation_id":"3ea41689-74ee-46e8-8825-400a384a8d00","resolution":{"observed_at":"2026-08-11T22:41:12.984953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-11T22:41:13.034748Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.034748Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:aaa2d7c9a74b80615e41d06efd93cd87e0e73ccc05d1f4c8d3e65555e8a8fc92","observation_id":"9b4bc44d-42e1-46ef-a64b-154aa3eccc72","resolution":{"observed_at":"2026-08-11T22:41:13.034748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T22:41:13.094829Z","title":"Touvron, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.094829Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0d3131ea11f7232aedba7aa77f08e0cc3cfaec7cdd404dcb8f3c5e1db2c79198","observation_id":"99099306-cb37-49bd-848e-36068b8c5514","resolution":{"observed_at":"2026-08-11T22:41:13.094829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.142424Z","title":"Raffel, N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.142424Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:8f7557a99fc6d70f9c7d5b1190a101395eb5d4307df9137166171c4cad1a1bad","observation_id":"63994313-858f-4e82-9fa3-ea3eacf55217","resolution":{"observed_at":"2026-08-11T22:41:13.142424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10360","last_updated":"2022-03-17T11:49:55Z","snapshot_observed_at":"2026-08-14T02:58:45.675852Z","submitted_at":"2021-03-18T16:30:26Z","title":"GLM: General Language Model Pretraining with Autoregressive Blank Infilling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10360","snapshot_observed_at":"2026-08-11T22:41:13.194752Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.194752Z"},"links":{"cited_paper":"/paper/2103.10360","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:35d1d7423b29244d60eb7d0a45a9206e8f0eb445a74fa6f3fe021ca3ac403cf9","observation_id":"660fb039-eeaa-4248-bb64-82eb8c5e0c1b","resolution":{"observed_at":"2026-08-11T22:41:13.194752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T22:41:13.234747Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.234747Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:34e543a42e4bb881baf93b3377998a5faf1c122a68cbe369937a1f9d4f6a75bd","observation_id":"3b3bf56c-dfb7-4c16-b88a-44762cdc999e","resolution":{"observed_at":"2026-08-11T22:41:13.234747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.284749Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.284749Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:90362e4ae9252e5cb26ebc4853567e94672d157d12085c39d91b534d0603b01c","observation_id":"0e41000f-db14-499d-8dc0-56e9af14a393","resolution":{"observed_at":"2026-08-11T22:41:13.284749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.464746Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.464746Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1819d94603ff37d3bf213e2b1b338afa0f52f6afd9fdf289c4b53a3f70acb07e","observation_id":"f85d7e6b-f2f5-4dce-928c-8424acba7147","resolution":{"observed_at":"2026-08-11T22:41:13.464746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.514751Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.514751Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0c62b02fbcb32579af109285c14ec788cd89a2cae196e650cefbc72942abf595","observation_id":"2896e017-ae70-41e1-9447-ebebd127b13d","resolution":{"observed_at":"2026-08-11T22:41:13.514751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.576025Z","title":"Radford, L","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.576025Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5340d1d98be9001bfbb7eba12d0055024929f996f7f31940bab9f4d420fe638f","observation_id":"d3b15ef5-dea0-4bf9-8c95-664d56f8ca0a","resolution":{"observed_at":"2026-08-11T22:41:13.576025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-08-12T18:51:00.108451Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-11T22:41:13.616190Z","title":"Mirza and S","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.616190Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f9a7a85565a2bf39bee4d49a896906174a14c1182299d93e57632f37b0f3b8db","observation_id":"630bcbc0-0218-4c70-97d2-244c5e9d2920","resolution":{"observed_at":"2026-08-11T22:41:13.616190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07875","last_updated":"2017-12-06T20:01:54Z","snapshot_observed_at":"2026-07-06T05:27:45.080675Z","submitted_at":"2017-01-26T21:10:29Z","title":"Wasserstein GAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07875","snapshot_observed_at":"2026-08-11T22:41:13.664741Z","title":"Arjovsky, S","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.664741Z"},"links":{"cited_paper":"/paper/1701.07875","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:372fafee53fe0795ab532ee91bba97212426148d15b19bf78983971752f1593f","observation_id":"c2df0cdc-0b73-4b14-9323-f10b16ec2019","resolution":{"observed_at":"2026-08-11T22:41:13.664741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.710992Z","title":"Gulrajani, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.710992Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:cf6b4da5ebdd4b6341f44debaabf21eedc607555f3330be98e7cb912063ae4c9","observation_id":"e0270453-fb20-49b2-b7a4-69f4a3fd17bf","resolution":{"observed_at":"2026-08-11T22:41:13.710992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.744808Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.744808Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:631429665ce762295b3ad0e23d0697f451609675e1085319e842c059dc8b818c","observation_id":"39a5fa45-b4ba-4d99-bb91-21e8a974ab59","resolution":{"observed_at":"2026-08-11T22:41:13.744808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.783949Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.783949Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:7215ed9d694f012f78e0816a206ea3167a735d2a0b8b91bf0839bf44a63f2eb8","observation_id":"b0692ddb-1d52-400e-9fc6-5869f70f3fbd","resolution":{"observed_at":"2026-08-11T22:41:13.783949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.845286Z","title":"Karras, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.845286Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f04e95202b464007c55824bb0ea4538124084faa0b86a5481b480c6ddcf5c309","observation_id":"cc5a096a-1c3f-4961-a8bb-288705d9aa77","resolution":{"observed_at":"2026-08-11T22:41:13.845286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.883530Z","title":"Zhang, I","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.883530Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1dc1894fd1fe1459d1814d7089f90ec9e01455760b1d4368a374c157f748ef09","observation_id":"5bd0b2ca-f6fd-41e8-a770-9dbab1936d58","resolution":{"observed_at":"2026-08-11T22:41:13.883530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.925073Z","title":"Brock, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.925073Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0716e28ce19663e374097fa4941ee6af38fb37681d0c50178a8b9a85445cdae6","observation_id":"7a3db675-eef9-4d9b-a15e-c8331eab7966","resolution":{"observed_at":"2026-08-11T22:41:13.925073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.974848Z","title":"Karras, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.974848Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1221c7a8477730b139f9461bec93a490749f9566fa95bab01f05c6357d4c7b41","observation_id":"389d6f84-5d39-4922-b9d3-bd96cf8367d0","resolution":{"observed_at":"2026-08-11T22:41:13.974848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.025423Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.025423Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:d4f75051f0b6047cde13e11ab2791c855525e0aefc45f94f7c334204306a01af","observation_id":"c0c74810-f18b-4e4e-8348-09529137e5e7","resolution":{"observed_at":"2026-08-11T22:41:14.025423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.064745Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.064745Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:06a9316a4b363f0f9d5a0411e2b9806456ad373a0d216bdc225e53b1b808ad79","observation_id":"cecc579d-fbd1-49f3-84e4-dac0751183ed","resolution":{"observed_at":"2026-08-11T22:41:14.064745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.114887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.114887Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:c8751756a5db86c133b8860eee5e674a5f9e9bd81e5b92e87062fd77f5fa31bc","observation_id":"6eb8058d-3ce2-4580-9cf8-7575eeaa4beb","resolution":{"observed_at":"2026-08-11T22:41:14.114887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.150250Z","title":"Creswell, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.150250Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b20a30d3ffbb794ffda1b4ccd64f268132be6da5a1c9f8726a5bc8bef4ad7a71","observation_id":"034b2214-39b0-4ad1-b00b-7a18157124c1","resolution":{"observed_at":"2026-08-11T22:41:14.150250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00770","last_updated":"2024-07-12T20:29:57Z","snapshot_observed_at":"2026-08-14T15:19:39.533992Z","submitted_at":"2023-09-02T00:32:55Z","title":"Bias and Fairness in Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00770","snapshot_observed_at":"2026-08-11T22:41:14.204747Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.204747Z"},"links":{"cited_paper":"/paper/2309.00770","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1b0767ec91b261ef62e506248b8c396b0a1c80778e5c69a5bb1a636aa9e5b771","observation_id":"5b62a655-9e91-4f45-a9bd-e53ffa61f0f4","resolution":{"observed_at":"2026-08-11T22:41:14.204747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16789","last_updated":"2024-11-25T05:27:13Z","snapshot_observed_at":"2026-08-13T00:22:04.546556Z","submitted_at":"2024-04-25T17:38:57Z","title":"Continual Learning of Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16789","snapshot_observed_at":"2026-08-11T22:41:14.234747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.234747Z"},"links":{"cited_paper":"/paper/2404.16789","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f769c1c1f31663e3ca517fc074417825a44dd3099a8fe5f2989d4e510553d716","observation_id":"d945bd22-8c68-447c-8a5a-bb1a1f036d76","resolution":{"observed_at":"2026-08-11T22:41:14.234747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-11T22:41:14.294882Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.294882Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:a6d85075a41ad7650491d246d8e749d37459523a886177647d999fa70fb39155","observation_id":"31fc77eb-a1cc-426d-8a23-49dcc4162fa7","resolution":{"observed_at":"2026-08-11T22:41:14.294882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17944","last_updated":"2024-06-21T19:59:54Z","snapshot_observed_at":"2026-08-14T07:39:26.197005Z","submitted_at":"2024-02-27T23:59:01Z","title":"Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17944","snapshot_observed_at":"2026-08-11T22:41:14.345214Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.345214Z"},"links":{"cited_paper":"/paper/2402.17944","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:ae4ae54f8a1d4014aacbeae2eeb4e323621c6873c03b3e2fd843949c882af3d7","observation_id":"d6db71df-c293-411f-a2e9-7beda3ae84e4","resolution":{"observed_at":"2026-08-11T22:41:14.345214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00888","last_updated":"2024-11-14T22:20:49Z","snapshot_observed_at":"2026-08-13T04:32:07.137910Z","submitted_at":"2024-01-30T04:00:54Z","title":"Security and Privacy Challenges of Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00888","snapshot_observed_at":"2026-08-11T22:41:14.395130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.395130Z"},"links":{"cited_paper":"/paper/2402.00888","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:fb4d30a83e8b423ab2272c28069a517a4ff411f57e5325d509e36f180a19e6fc","observation_id":"724fe2e1-587a-4765-a1d6-789ba37618ea","resolution":{"observed_at":"2026-08-11T22:41:14.395130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.424222Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.424222Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b7b5c93213a7fc0b3bef761517dbad7055ef434f5092db48078149e2c868de5f","observation_id":"0974a574-cc52-4b13-a953-84ab8c59dd33","resolution":{"observed_at":"2026-08-11T22:41:14.424222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19860","last_updated":"2024-06-18T08:07:01Z","snapshot_observed_at":"2026-08-13T11:28:25.252997Z","submitted_at":"2023-05-31T13:51:26Z","title":"A Survey on Large Language Models for Recommendation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19860","snapshot_observed_at":"2026-08-11T22:41:14.472686Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.472686Z"},"links":{"cited_paper":"/paper/2305.19860","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5bb5db0ba660e6f3a661c7fa39b9bd1e7312bdfe9ab903ce589038ba5f11abf6","observation_id":"aee479cc-df80-4ae9-b7a1-071c7fafa703","resolution":{"observed_at":"2026-08-11T22:41:14.472686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16651","last_updated":"2024-04-25T14:42:12Z","snapshot_observed_at":"2026-08-13T00:22:14.278705Z","submitted_at":"2024-04-25T14:42:12Z","title":"Evolutionary Large Language Models for Hardware Security: A Comparative Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16651","snapshot_observed_at":"2026-08-11T22:41:14.514845Z","title":"Akyash and H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.514845Z"},"links":{"cited_paper":"/paper/2404.16651","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4b3546ba6eea672894cd7be70637753d457da8560d61a1617be3307d841a2941","observation_id":"1eb92f68-c294-476d-9b6c-34e876e79e0a","resolution":{"observed_at":"2026-08-11T22:41:14.514845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16640","last_updated":"2024-07-18T09:01:52Z","snapshot_observed_at":"2026-08-12T23:57:42.090430Z","submitted_at":"2024-05-26T17:31:21Z","title":"A Survey of Multimodal Large Language Model from A Data-centric Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16640","snapshot_observed_at":"2026-08-11T22:41:14.554744Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.554744Z"},"links":{"cited_paper":"/paper/2405.16640","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:9d38ff89f92c36352e9631a597c828ed4565d47f2a8f712a3549f891a55edeed","observation_id":"c883a0dd-0216-4117-9b13-51557488ce14","resolution":{"observed_at":"2026-08-11T22:41:14.554744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08603","last_updated":"2024-12-30T15:08:23Z","snapshot_observed_at":"2026-08-14T13:12:43.325097Z","submitted_at":"2024-05-14T13:42:05Z","title":"A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08603","snapshot_observed_at":"2026-08-11T22:41:14.590275Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.590275Z"},"links":{"cited_paper":"/paper/2405.08603","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:555f42df76e943b7796e14acccebb9298e95ee10c43affdc74deec7256e23830","observation_id":"0cefb2fc-e9cc-4b33-8bb7-133ebc5a3dc1","resolution":{"observed_at":"2026-08-11T22:41:14.590275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10825","last_updated":"2024-09-16T05:09:57Z","snapshot_observed_at":"2026-08-13T00:05:03.645081Z","submitted_at":"2024-05-17T14:46:13Z","title":"Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10825","snapshot_observed_at":"2026-08-11T22:41:14.594639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.594639Z"},"links":{"cited_paper":"/paper/2405.10825","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:3bf1eb18cb7aa02f2ec8f636b35b8a530fc2112773c6283b1548d7932f43793c","observation_id":"75dc30b6-818b-482d-a0a7-73089081f7d4","resolution":{"observed_at":"2026-08-11T22:41:14.594639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15777","last_updated":"2024-05-29T15:50:43Z","snapshot_observed_at":"2026-08-13T00:23:09.137603Z","submitted_at":"2024-04-24T09:55:24Z","title":"A Comprehensive Survey on Evaluating Large Language Model Applications in the Medical Industry","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15777","snapshot_observed_at":"2026-08-11T22:41:14.602344Z","title":"Huang, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.602344Z"},"links":{"cited_paper":"/paper/2404.15777","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5f2a405299f57ebbf0bfdfcd6b17bc64f71d4406e83964cdfce9427528dc7864","observation_id":"e638447b-cd3d-4beb-b3a1-b9def98e536c","resolution":{"observed_at":"2026-08-11T22:41:14.602344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17935","last_updated":"2024-11-04T15:07:18Z","snapshot_observed_at":"2026-08-12T23:56:25.127377Z","submitted_at":"2024-05-28T08:01:26Z","title":"Tool Learning with Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17935","snapshot_observed_at":"2026-08-11T22:41:14.606247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.606247Z"},"links":{"cited_paper":"/paper/2405.17935","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b7a273263e0e00c2c355060f7a28835d70699a9f4547ef5e27bab96eed7194f7","observation_id":"460b2754-3430-4ff0-bd86-fa64385ab668","resolution":{"observed_at":"2026-08-11T22:41:14.606247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12819","last_updated":"2025-08-25T02:35:43Z","snapshot_observed_at":"2026-08-13T00:02:56.561615Z","submitted_at":"2024-05-21T14:24:01Z","title":"Large Language Models Meet NLP: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12819","snapshot_observed_at":"2026-08-11T22:41:14.635156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.635156Z"},"links":{"cited_paper":"/paper/2405.12819","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:56985fa753b67fa14536f740f3edde51f5f129bb113808847128392fc6716e4d","observation_id":"edb33011-29a2-415c-9eee-5e4335c19aa1","resolution":{"observed_at":"2026-08-11T22:41:14.635156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02357","last_updated":"2025-02-21T03:14:05Z","snapshot_observed_at":"2026-08-13T00:15:43.164547Z","submitted_at":"2024-05-03T02:54:43Z","title":"Large Language Models for Mobility Analysis in Transportation Systems: A Survey on Forecasting Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02357","snapshot_observed_at":"2026-08-11T22:41:14.674740Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.674740Z"},"links":{"cited_paper":"/paper/2405.02357","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:a1bdc84818dca4d7b2d7b34eadadcfc4589238b9dc655d37021495edbd1ea837","observation_id":"579a6357-7262-4508-b0ed-5939fd1e1c19","resolution":{"observed_at":"2026-08-11T22:41:14.674740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.724749Z","title":"Kukreja, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.724749Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:52410f835e1b81da8b3d625160464fb2562407d7194cb33b0a0082bb97487b61","observation_id":"e55d65d3-270b-4d54-8e7f-6c571e9316eb","resolution":{"observed_at":"2026-08-11T22:41:14.724749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04925","last_updated":"2024-04-07T11:52:44Z","snapshot_observed_at":"2026-08-13T00:35:36.874116Z","submitted_at":"2024-04-07T11:52:44Z","title":"Multilingual Large Language Model: A Survey of Resources, Taxonomy and Frontiers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04925","snapshot_observed_at":"2026-08-11T22:41:14.774825Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.774825Z"},"links":{"cited_paper":"/paper/2404.04925","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4c27de45e615bb0d37a2b24ba78c14da04609e5364e5d5d408ee9ebd7c979b5b","observation_id":"863bc4ed-d05c-4429-9d07-57ab6a0035c9","resolution":{"observed_at":"2026-08-11T22:41:14.774825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11457","last_updated":"2024-08-21T17:23:03Z","snapshot_observed_at":"2026-08-13T00:28:08.722362Z","submitted_at":"2024-04-17T15:05:03Z","title":"Bias and Unfairness in Information Retrieval Systems: New Challenges in the LLM Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11457","snapshot_observed_at":"2026-08-11T22:41:14.824752Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.824752Z"},"links":{"cited_paper":"/paper/2404.11457","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:29ea84382649e9e529c63556db8cc340a7bec0bb52082aaf3e9548cb7cc1f62c","observation_id":"1b096fbc-c65c-4343-8040-bfec3a2eef95","resolution":{"observed_at":"2026-08-11T22:41:14.824752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-11T22:41:14.874745Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.874745Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:68ef9efbb8bee93a53f7befc9f339e6b662dfd451b63ae277f903caa0b52475b","observation_id":"e9d26b44-ab36-48fa-822f-5968a4bd48b9","resolution":{"observed_at":"2026-08-11T22:41:14.874745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13501","last_updated":"2024-04-21T01:49:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-21T01:49:46Z","title":"A Survey on the Memory Mechanism of Large Language Model based Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13501","snapshot_observed_at":"2026-08-11T22:41:14.914745Z","title":"Zhang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.914745Z"},"links":{"cited_paper":"/paper/2404.13501","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:982bcbb1b39a9371d23329569068ae8634cb16e38bf01e51d383d28ceb68ec7c","observation_id":"64ed5af9-8f63-4bce-a8ed-faf5267955d7","resolution":{"observed_at":"2026-08-11T22:41:14.914745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02039","last_updated":"2026-06-08T03:25:04Z","snapshot_observed_at":"2026-08-13T00:39:11.868035Z","submitted_at":"2024-04-02T15:34:18Z","title":"A Survey on Large Language Model-Based Game Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02039","snapshot_observed_at":"2026-08-11T22:41:14.964744Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.964744Z"},"links":{"cited_paper":"/paper/2404.02039","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:80c2dc78d773c3df0cc13d0cea828be57aab7d34b344b9ba8130da8a06581253","observation_id":"43f602a8-4800-4c2d-8af6-5a55cf5dcfba","resolution":{"observed_at":"2026-08-11T22:41:14.964744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-11T22:41:15.014745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.014745Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f5f96b4095f9b036f66707052c5f74da3013aa6bfb035791c07271f2f0b61e35","observation_id":"aa9547f7-a026-404b-9fab-c124a91e0759","resolution":{"observed_at":"2026-08-11T22:41:15.014745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10981","last_updated":"2024-08-23T00:17:02Z","snapshot_observed_at":"2026-08-14T10:51:21.055151Z","submitted_at":"2024-04-17T01:27:42Z","title":"A Survey on Retrieval-Augmented Text Generation for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10981","snapshot_observed_at":"2026-08-11T22:41:15.054746Z","title":"Huang and J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.054746Z"},"links":{"cited_paper":"/paper/2404.10981","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:e463590c5f399a853eb368072c1a5b2f2ad90f10ab71766edac37ca0cf1c1947","observation_id":"037f8e6f-bcc6-479b-8f5d-da5d8d6c0faf","resolution":{"observed_at":"2026-08-11T22:41:15.054746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.095938Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.095938Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:d2d5044855d67e284c9f4c6fa42afc6a644fd8b6a5254436ef22dff8a5d62d3c","observation_id":"e3e3287d-fa30-4525-b692-d25fffbf3da7","resolution":{"observed_at":"2026-08-11T22:41:15.095938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-11T22:41:15.144746Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.144746Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0c9e7bf9c000db9314d2ebe955be88e26bb51dd685bda1d33945cf288e020e12","observation_id":"87bdff43-1290-4a18-92f9-803331f1d049","resolution":{"observed_at":"2026-08-11T22:41:15.144746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.193425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.193425Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:04ab48e6715f1245d04b084e8224d671620dd66f414f446a378d071824b37ed6","observation_id":"f794ce7d-b28e-4206-981c-695466e0df31","resolution":{"observed_at":"2026-08-11T22:41:15.193425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.234819Z","title":"Chang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.234819Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:638121ebbf5b9f1f99a2ad38b8a10c16b52d9a1a3c2fc99f2a5ec55ac0adbfdb","observation_id":"2c7e704d-cdb1-475a-b9c1-44061ce33790","resolution":{"observed_at":"2026-08-11T22:41:15.234819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-11T22:41:15.264745Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.264745Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0dcd425cdc0116eb976980299a6ecd43f41866ad69354d316d8cd37d842172ad","observation_id":"a19ad175-8681-47b6-8b8b-287325f74473","resolution":{"observed_at":"2026-08-11T22:41:15.264745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.316149Z","title":"Zhang, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.316149Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:519e035217d8e42c90b849bc4fd4c3f47fd5b30d4f4a135f60f4da607c41b689","observation_id":"dc0edaa1-11b1-443b-8435-0d87662b1b3d","resolution":{"observed_at":"2026-08-11T22:41:15.316149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.364751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.364751Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:55dd71a7d268064304beea3d4bfb179b842787c825b0dc8b0d40e195048c9c4a","observation_id":"ac9af0bd-0cbd-4429-8d80-afebba180588","resolution":{"observed_at":"2026-08-11T22:41:15.364751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05156","last_updated":"2024-03-14T14:17:57Z","snapshot_observed_at":"2026-08-13T00:59:28.434753Z","submitted_at":"2024-03-08T08:47:48Z","title":"On Protecting the Data Privacy of Large Language Models (LLMs): A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05156","snapshot_observed_at":"2026-08-11T22:41:15.424747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.424747Z"},"links":{"cited_paper":"/paper/2403.05156","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:bbf037ce4b82a6303437bbf92b2b8d9f544917180ccf7b388452ceaf08c9017a","observation_id":"2705337f-f043-49da-ae83-88da001d3f9e","resolution":{"observed_at":"2026-08-11T22:41:15.424747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00282","last_updated":"2024-10-30T02:22:46Z","snapshot_observed_at":"2026-08-13T00:41:00.933176Z","submitted_at":"2024-03-30T08:28:08Z","title":"Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00282","snapshot_observed_at":"2026-08-11T22:41:15.474746Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.474746Z"},"links":{"cited_paper":"/paper/2404.00282","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:33fc954647d9ec636544afd629d3a2a329249cd55a86fe3430181b0e986b7b9e","observation_id":"e361eef6-ebf3-4e4b-b2f3-f2944eba3770","resolution":{"observed_at":"2026-08-11T22:41:15.474746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09606","last_updated":"2025-03-21T04:57:45Z","snapshot_observed_at":"2026-08-14T10:48:29.978839Z","submitted_at":"2024-03-14T17:47:20Z","title":"Large Language Models and Causal Inference in Collaboration: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09606","snapshot_observed_at":"2026-08-11T22:41:15.524927Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.524927Z"},"links":{"cited_paper":"/paper/2403.09606","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:a795e5c5b5370f11df47dd4de6b290e1acba33c40936ba0d79ef221078b23a0d","observation_id":"fa2d271b-7d3e-4450-b6f3-4ea87f91180f","resolution":{"observed_at":"2026-08-11T22:41:15.524927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.574737Z","title":"Esmradi, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.574737Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:35923d1edf4976bd5b59f526d817b1e0226f249ff655ad79cd80df1f50decf2c","observation_id":"d2fcd1c0-4f7c-4b9a-a6b5-0ca6d394a36b","resolution":{"observed_at":"2026-08-11T22:41:15.574737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.614892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.614892Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:7c669528a49e638faade361366d3d7e934629c102290d806e7ba8b490da54468","observation_id":"1cb29da8-099c-48e0-a0a1-cb2a643a3f97","resolution":{"observed_at":"2026-08-11T22:41:15.614892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09136","last_updated":"2023-03-16T08:01:22Z","snapshot_observed_at":"2026-08-13T12:23:35.027818Z","submitted_at":"2023-03-16T08:01:22Z","title":"A Short Survey of Viewing Large Language Models in Legal Aspect","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09136","snapshot_observed_at":"2026-08-11T22:41:15.655796Z","title":"Sun, ‘‘A short survey of viewing large language models in legal aspect,’’ arXiv preprint arXiv:2303.09136, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.655796Z"},"links":{"cited_paper":"/paper/2303.09136","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:71478fcd0d965d8c241f26949f96003bff9007e546c1770b9fdb15abd8730955","observation_id":"4c064255-8a07-4034-92bd-1a1827bac0c9","resolution":{"observed_at":"2026-08-11T22:41:15.655796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.694733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.694733Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:e9d9edd08152c58fcdb4c07b1761f1052e6f1180b3a689c105e8ad9c6fbc649b","observation_id":"20b011b1-5dd7-49be-b612-5e5d6fd24875","resolution":{"observed_at":"2026-08-11T22:41:15.694733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.744742Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.744742Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:acc345bdd30dd3bf7f6d15d93efd2ccf99c828913c607497ba811979f7b105f2","observation_id":"99119285-170e-4c1d-88eb-08859e1d5815","resolution":{"observed_at":"2026-08-11T22:41:15.744742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16765","last_updated":"2024-01-30T06:04:04Z","snapshot_observed_at":"2026-08-13T04:32:04.658955Z","submitted_at":"2024-01-30T06:04:04Z","title":"A Cross-Language Investigation into Jailbreak Attacks in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16765","snapshot_observed_at":"2026-08-11T22:41:15.794741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.794741Z"},"links":{"cited_paper":"/paper/2401.16765","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:00b53fc56ba08b590589ba10feb183ca5080b7568b7a6305120a2128fe712b6e","observation_id":"6dadc31c-c90f-409c-8059-92e570f396f2","resolution":{"observed_at":"2026-08-11T22:41:15.794741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-09T18:54:02.679174Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-11T22:41:15.834839Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.834839Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:fad7e68844a3f5acc04c1ed1746d161b94dd34e6b97de50ffbc5f37a6fbc68b2","observation_id":"191fc505-7715-4e55-a1f0-09fe7e69f831","resolution":{"observed_at":"2026-08-11T22:41:15.834839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-11T22:41:15.864583Z","title":"Huang, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.864583Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:8a08119b8e3a00191060ec6ff7ffd5a095a26df6b94b6c0a405d71ca16c1c1d2","observation_id":"5fd2d318-4117-4ba3-8955-dd53254813b0","resolution":{"observed_at":"2026-08-11T22:41:15.864583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10844","last_updated":"2023-10-16T21:37:24Z","snapshot_observed_at":"2026-08-13T05:48:02.836662Z","submitted_at":"2023-10-16T21:37:24Z","title":"Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10844","snapshot_observed_at":"2026-08-11T22:41:15.914751Z","title":"Shayegani, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.914751Z"},"links":{"cited_paper":"/paper/2310.10844","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:92ff286acb408270de58ae1e72a92f612472e2904d737366fc9c2626ee5fd3d8","observation_id":"abe44304-5351-4a34-8d76-63fee4073b07","resolution":{"observed_at":"2026-08-11T22:41:15.914751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.965401Z","title":"Zhang, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.965401Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:da4646547b1cc6c244f81d3201193b5b093220e93ff2ef90dcbef6dc70113229","observation_id":"05ba6c55-8832-47b0-a5ff-faee2c3304e4","resolution":{"observed_at":"2026-08-11T22:41:15.965401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.005506Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.005506Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:d623f993d7e9f1319b0185dbb1c38eb2cb2475b32e6c1f889fb6dfe7ca3bdbe3","observation_id":"dd7e8289-44f3-42fa-90bb-7ebb5ddce20f","resolution":{"observed_at":"2026-08-11T22:41:16.005506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-11T22:41:16.054823Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.054823Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b241d6ea964e028bd9e1a6eca2fcd0877b05574e3baa6cd4d49ed8110d7a0719","observation_id":"33653165-f121-4212-9a00-869967d74eb0","resolution":{"observed_at":"2026-08-11T22:41:16.054823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-13T10:34:25.802574Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T22:41:16.084747Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.084747Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1c972f09adb1d9957a63de74f1d1608aa510bf1622dce7e6456fa03311ae49e7","observation_id":"b4d59a57-c4c1-485d-9f12-a06f45e2ba99","resolution":{"observed_at":"2026-08-11T22:41:16.084747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.122350Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.122350Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:6803b38d02dd7777c555b58af7a2478bbe44f9e6e8d31a07cb1e25c61e074bc9","observation_id":"f4f921ca-48d9-4c02-bbaa-9a88d19fab9d","resolution":{"observed_at":"2026-08-11T22:41:16.122350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.156378Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.156378Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:3dd6f5e3cbb07a02408b1c183f2d4a8a2c7e4354c421f07a2f4427550d29377a","observation_id":"abe42053-0a7c-4ec0-ba0d-6b2bcff4c689","resolution":{"observed_at":"2026-08-11T22:41:16.156378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10403","last_updated":"2023-05-26T17:59:33Z","snapshot_observed_at":"2026-08-06T19:23:30.079167Z","submitted_at":"2022-12-20T16:29:03Z","title":"Towards Reasoning in Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10403","snapshot_observed_at":"2026-08-11T22:41:16.194745Z","title":"Huang and K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.194745Z"},"links":{"cited_paper":"/paper/2212.10403","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4bccc2fb42c6b1b37b28ab6e6c79cb207fba867bb001f2990a30f2beb19583cb","observation_id":"9dc52745-a088-4959-a298-77e8fb2851ae","resolution":{"observed_at":"2026-08-11T22:41:16.194745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.206532Z","title":"Kasneci, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.206532Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:22f2ed67b345a99ded48a520ee4046755ef363e1761404a64c41016130d74cb4","observation_id":"ab47a09b-ffe1-4490-a8d3-c47be1317bbe","resolution":{"observed_at":"2026-08-11T22:41:16.206532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-11T22:41:16.213831Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.213831Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1a4969eab00fdf69e968ef04f634a8ce7c89e81a05e00439ff96707e69d56a64","observation_id":"f5588410-6792-4c2a-be41-5526930efce6","resolution":{"observed_at":"2026-08-11T22:41:16.213831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07842","last_updated":"2023-02-15T18:25:52Z","snapshot_observed_at":"2026-07-30T02:11:00.198428Z","submitted_at":"2023-02-15T18:25:52Z","title":"Augmented Language Models: a Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07842","snapshot_observed_at":"2026-08-11T22:41:16.232176Z","title":"Mialon, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.232176Z"},"links":{"cited_paper":"/paper/2302.07842","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0f6cd10d051327f1b4daac83146dead514e1ce501c0214cdb629ec94f514f98b","observation_id":"d12345bc-dcef-4d67-a2d7-6654e0c0de12","resolution":{"observed_at":"2026-08-11T22:41:16.232176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.250430Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.250430Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:e1a734fed791e7b49386341755b8fee7052d221965ddea88b05a4813c1059821","observation_id":"6b3aa84c-15ec-46a4-a165-78190aa69561","resolution":{"observed_at":"2026-08-11T22:41:16.250430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05542","last_updated":"2021-08-28T05:59:16Z","snapshot_observed_at":"2026-08-13T18:29:49.245998Z","submitted_at":"2021-08-12T05:32:18Z","title":"AMMUS : A Survey of Transformer-based Pretrained Models in Natural Language Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05542","snapshot_observed_at":"2026-08-11T22:41:16.258290Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.258290Z"},"links":{"cited_paper":"/paper/2108.05542","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:bb55bfe4eaf6b0d02316c9370a5ec282df9d51796bf42637bd33820870fba3fb","observation_id":"09fd1a7a-03b5-4a91-b73a-35df04ebdd5a","resolution":{"observed_at":"2026-08-11T22:41:16.258290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.274751Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.274751Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:00e98b74b8d134f55a61915399fd4c64f1d34da21cb9bffb98b54c6d934a890f","observation_id":"ac054396-6170-4c4c-82ab-04d2055111d9","resolution":{"observed_at":"2026-08-11T22:41:16.274751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.324731Z","title":"Houlsby, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.324731Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:ba2a57e23984d874b5880e2fd2f71429e9e24f28c56700246216ddce1de65452","observation_id":"9c039228-d497-45a1-9c32-d9ddf0504227","resolution":{"observed_at":"2026-08-11T22:41:16.324731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04366","last_updated":"2022-02-02T16:39:23Z","snapshot_observed_at":"2026-08-13T17:56:57.877812Z","submitted_at":"2021-10-08T20:22:26Z","title":"Towards a Unified View of Parameter-Efficient Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04366","snapshot_observed_at":"2026-08-11T22:41:16.374738Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.374738Z"},"links":{"cited_paper":"/paper/2110.04366","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:51b82f714e33ebd9f483de2d32225bfe7dc95580fba73e7cf155e97e07e40610","observation_id":"14852458-c03e-4c7e-ac72-5d804c625d8c","resolution":{"observed_at":"2026-08-11T22:41:16.374738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08154","last_updated":"2021-09-12T09:10:43Z","snapshot_observed_at":"2026-08-07T09:24:32.417029Z","submitted_at":"2021-04-16T14:58:28Z","title":"Counter-Interference Adapter for Multilingual Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08154","snapshot_observed_at":"2026-08-11T22:41:16.415363Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.415363Z"},"links":{"cited_paper":"/paper/2104.08154","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:8b9fd5fc855bd96a88dfbffb1c8d1bf08494e3b4146d11187abf92ee0cd5841c","observation_id":"ba337ff2-8ee6-4a83-9ed4-f84e8b50637d","resolution":{"observed_at":"2026-08-11T22:41:16.415363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04947","last_updated":"2023-11-26T22:00:36Z","snapshot_observed_at":"2026-08-14T17:26:27.404750Z","submitted_at":"2023-04-11T03:17:37Z","title":"Conditional Adapters: Parameter-efficient Transfer Learning with Fast Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04947","snapshot_observed_at":"2026-08-11T22:41:16.457033Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.457033Z"},"links":{"cited_paper":"/paper/2304.04947","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:27f1eb5b804f2f5e09a27af5a1bf89eb694fe29abfe234c107c25bfdd797c080","observation_id":"34a495c4-b219-4dcf-b47b-bf9f681490d0","resolution":{"observed_at":"2026-08-11T22:41:16.457033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00247","last_updated":"2021-01-26T12:54:33Z","snapshot_observed_at":"2026-08-11T03:47:32.551562Z","submitted_at":"2020-05-01T07:03:42Z","title":"AdapterFusion: Non-Destructive Task Composition for Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00247","snapshot_observed_at":"2026-08-11T22:41:16.462542Z","title":"Pfeiffer, A","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.462542Z"},"links":{"cited_paper":"/paper/2005.00247","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4c2da6f4f5af98acc2b548ba085dc51eab256de808ca81ddd86cb680ef0c12cb","observation_id":"4146b7c1-5000-4f5c-a439-2159422a874e","resolution":{"observed_at":"2026-08-11T22:41:16.462542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12410","last_updated":"2022-11-02T02:47:17Z","snapshot_observed_at":"2026-08-13T15:37:41.574768Z","submitted_at":"2022-05-24T23:41:22Z","title":"AdaMix: Mixture-of-Adaptations for Parameter-efficient Model Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12410","snapshot_observed_at":"2026-08-11T22:41:16.467494Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.467494Z"},"links":{"cited_paper":"/paper/2205.12410","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:df689a1f110241dee36d9c7bc41cf0ff292f30821968ad900ffaddb96bd04691","observation_id":"974e048c-665b-4ab3-ab8f-79e91617b58c","resolution":{"observed_at":"2026-08-11T22:41:16.467494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11670","last_updated":"2023-11-11T15:30:30Z","snapshot_observed_at":"2026-08-13T05:47:11.344758Z","submitted_at":"2023-10-18T02:42:17Z","title":"Prototype-based HyperAdapter for Sample-Efficient Multi-task Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11670","snapshot_observed_at":"2026-08-11T22:41:16.473853Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.473853Z"},"links":{"cited_paper":"/paper/2310.11670","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:21aeac575a95974853f76d47f6d8ff180e6a737085a6865900f8b0596f72bf1c","observation_id":"eacfd047-015a-494b-aa2e-c9f059ce2dc7","resolution":{"observed_at":"2026-08-11T22:41:16.473853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07027","last_updated":"2023-03-28T13:37:54Z","snapshot_observed_at":"2026-08-13T12:44:46.344750Z","submitted_at":"2023-02-14T13:09:23Z","title":"AdapterSoup: Weight Averaging to Improve Generalization of Pretrained Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07027","snapshot_observed_at":"2026-08-11T22:41:16.479105Z","title":"Chronopoulou, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.479105Z"},"links":{"cited_paper":"/paper/2302.07027","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:3763b426743a09f9bb0ac1ffee3f4f8046529ce5ba258386cc887e0d3caed58b","observation_id":"813512e1-cfec-4f35-9daf-e5d650e76c64","resolution":{"observed_at":"2026-08-11T22:41:16.479105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15982","last_updated":"2023-08-30T12:10:17Z","snapshot_observed_at":"2026-08-13T10:24:15.479407Z","submitted_at":"2023-08-30T12:10:17Z","title":"MerA: Merging Pretrained Adapters For Few-Shot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15982","snapshot_observed_at":"2026-08-11T22:41:16.499358Z","title":"He, R.-Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.499358Z"},"links":{"cited_paper":"/paper/2308.15982","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:73db3ba091a7371275983691e9eb7c856197ca96b0dcc2fcfa7208606692864e","observation_id":"0bdc982a-e757-470b-b333-b8ea50432b9e","resolution":{"observed_at":"2026-08-11T22:41:16.499358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04489","last_updated":"2021-06-08T16:16:40Z","snapshot_observed_at":"2026-08-13T19:07:44.039577Z","submitted_at":"2021-06-08T16:16:40Z","title":"Parameter-efficient Multi-task Fine-tuning for Transformers via Shared Hypernetworks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04489","snapshot_observed_at":"2026-08-11T22:41:16.521964Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.521964Z"},"links":{"cited_paper":"/paper/2106.04489","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:e187b74c6351766e76b8f57e3fc592f7b8b1434106aa4b5923619d2297399f49","observation_id":"dce691b8-f18f-4294-b7e6-b9f7fa9d4771","resolution":{"observed_at":"2026-08-11T22:41:16.521964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-08-12T12:37:28.207761Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-11T22:41:16.554754Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.554754Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:6b94b17cdb25a4a7a89b1399691cf7c35b50bec4263b8d2608e375c6c5b0276f","observation_id":"b67e66eb-8e30-46b8-be79-95256142c204","resolution":{"observed_at":"2026-08-11T22:41:16.554754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12086","last_updated":"2023-05-24T21:13:24Z","snapshot_observed_at":"2026-08-13T11:38:20.560389Z","submitted_at":"2023-05-20T04:07:06Z","title":"Prefix Propagation: Parameter-Efficient Tuning for Long Sequences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12086","snapshot_observed_at":"2026-08-11T22:41:16.590001Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.590001Z"},"links":{"cited_paper":"/paper/2305.12086","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5eacb8c2cbec95a1648a9a7d041aea7a8d3f6f3ceb58bd83b1ef303fd56e1b72","observation_id":"a2aa64af-2cac-4ca4-966f-58d0ac4201c8","resolution":{"observed_at":"2026-08-11T22:41:16.590001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-14T08:27:33.738990Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-11T22:41:16.599307Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.599307Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:d24975f35df372089dfd8a50036c1e86ea38d5540cbc571a574344a03a70f0db","observation_id":"54cb2d41-b1e8-4cfd-b900-b284415c9fed","resolution":{"observed_at":"2026-08-11T22:41:16.599307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15212","last_updated":"2023-05-24T14:51:01Z","snapshot_observed_at":"2026-08-13T11:34:22.973849Z","submitted_at":"2023-05-24T14:51:01Z","title":"Towards Adaptive Prefix Tuning for Parameter-Efficient Language Model Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15212","snapshot_observed_at":"2026-08-11T22:41:16.654757Z","title":"Zhang, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.654757Z"},"links":{"cited_paper":"/paper/2305.15212","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b8ef9146c7315a234ef8966d8246f5de055866eff7f63e295bb55c9fc0df173f","observation_id":"c29b0258-87af-44c8-a039-369587852d2b","resolution":{"observed_at":"2026-08-11T22:41:16.654757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10385","last_updated":"2023-10-25T06:15:58Z","snapshot_observed_at":"2026-08-13T19:55:36.034752Z","submitted_at":"2021-03-18T17:13:50Z","title":"GPT Understands, Too","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10385","snapshot_observed_at":"2026-08-11T22:41:16.681006Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.681006Z"},"links":{"cited_paper":"/paper/2103.10385","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:42ccd6b44d6a41395974e3067a30fbe66fcef451528398c2808ef10acc2bcf94","observation_id":"f01d68d0-c585-41fb-a770-58a43cec40ea","resolution":{"observed_at":"2026-08-11T22:41:16.681006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T10:22:33.294462Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":299},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 299 outbound references and 0 inbound Pith citation observations for arXiv:2412.03220."}