{"as_of":"2026-08-08T23:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b279330f78c1f616136e82fbd7b15968d1b73ad9cf49eadfdb5e37ded677d7c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:20:38.174869Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":118,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-08T22:04:13.117781Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T22:29:29.631351Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2303.03378"},"observation_digest":"sha256:45a8657f50440c473097b8a4d7e7e56b4bd0c5bdf190bed9a2d0c77d6200a2a4","observation_id":"23729b9b-4725-47c5-9564-2da4060c3202","resolution":{"observed_at":"2026-05-10T22:29:29.833939Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2303.11381","last_updated":"2023-03-20T18:31:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-20T18:31:47Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T01:17:58.678036Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2303.11381"},"observation_digest":"sha256:3bfdafe513a7b308e7e158392df8c1754df0e31e238c5a20152a0bea12aae520","observation_id":"e95e3818-21d5-4680-8c7c-363a6e442c85","resolution":{"observed_at":"2026-05-14T01:17:58.737145Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2305.16264","last_updated":"2025-06-28T00:00:06Z","snapshot_observed_at":"2026-08-08T06:18:27.640980Z","submitted_at":"2023-05-25T17:18:55Z","title":"Scaling Data-Constrained Language Models","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T01:35:21.150772Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2305.16264"},"observation_digest":"sha256:16305ad1bd1e6bda4bcd46583df00e7a9461856c2cbf4b969e3a211192848ae1","observation_id":"2688c09a-5d90-4442-b90c-d2cfa5d9aac2","resolution":{"observed_at":"2026-05-18T01:35:21.596114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-08T16:20:38.174869Z","title":"Dehghani, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06244","last_updated":"2025-06-04T02:16:01Z","snapshot_observed_at":"2026-08-08T16:14:07.851679Z","submitted_at":"2025-02-10T08:23:05Z","title":"PiKE: Adaptive Data Mixing for Large-Scale Multi-Task Learning Under Low Gradient Conflicts","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:20:38.174869Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2502.06244"},"observation_digest":"sha256:62b9b2f1d923658ae0f4aeafcfc58dfe853507f9fd6903b6c361f17148e2bdf8","observation_id":"9573a299-a857-4fa5-b700-90716e570d7b","resolution":{"observed_at":"2026-08-08T16:20:38.174869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-08T11:44:44.160662Z","title":"F., Mahendran, A., Yu, F., Oliver, A., Huot, F., Bastings, J., Collier, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07753","last_updated":"2025-02-11T18:27:27Z","snapshot_observed_at":"2026-08-08T14:51:46.857146Z","submitted_at":"2025-02-11T18:27:27Z","title":"Direct Ascent Synthesis: Revealing Hidden Generative Capabilities in Discriminative Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:44.160662Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2502.07753"},"observation_digest":"sha256:66199d897cf5ab8e3ead6b127825baf034bbe0bd6d31275a8643be67ba426bdc","observation_id":"2133d3de-4b97-4476-9336-66851138504e","resolution":{"observed_at":"2026-08-08T11:44:44.160662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-07T11:11:40.412772Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03350","last_updated":"2025-06-03T19:43:58Z","snapshot_observed_at":"2026-08-07T13:32:09.488526Z","submitted_at":"2025-06-03T19:43:58Z","title":"Adversarial Attacks on Robotic Vision Language Action Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:11:40.412772Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2506.03350"},"observation_digest":"sha256:f5f1cc673cb06e26da830e08abe8bd56dcbf12ac5676eb7878a96bb172c25719","observation_id":"7d02eae8-43dc-4400-8256-542870d7463b","resolution":{"observed_at":"2026-08-07T11:11:40.412772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-06T22:29:59.436591Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21411","last_updated":"2025-06-26T15:58:14Z","snapshot_observed_at":"2026-08-07T00:32:44.003375Z","submitted_at":"2025-06-26T15:58:14Z","title":"Distributed Cross-Channel Hierarchical Aggregation for Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:29:59.436591Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2506.21411"},"observation_digest":"sha256:6713a05908174b224319ee65f1eadcfc67cdac36372ad54862abd21830f8ba1a","observation_id":"1a4ac500-b51a-4f0b-8103-a72bd24ed971","resolution":{"observed_at":"2026-08-06T22:29:59.436591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2508.19651","last_updated":"2026-05-12T19:34:21Z","snapshot_observed_at":"2026-08-06T05:28:20.001697Z","submitted_at":"2025-08-27T07:58:57Z","title":"Scalable Object Detection in the Car Interior With Vision Foundation Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T21:07:31.589011Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2508.19651"},"observation_digest":"sha256:2de4da309f7daf5db786ca65a9087362fddeec1c2423c005f6ae934fa6f31bda","observation_id":"d38b0cd0-40aa-4a9d-a794-0a3d11f0e51d","resolution":{"observed_at":"2026-05-18T21:11:50.831055Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2601.14053","last_updated":"2026-04-16T15:26:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-20T15:06:19Z","title":"LLMOrbit: A Circular Taxonomy of Large Language Models -From Scaling Walls to Agentic AI Systems","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T12:47:28.248540Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2601.14053"},"observation_digest":"sha256:c30b47e770f519a494d6a37cfeca00f39db2ff2064976cffbffc166f24d01a0d","observation_id":"adddb5ec-da02-467e-b030-836e6a73746c","resolution":{"observed_at":"2026-05-16T12:47:53.644339Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2601.21798","last_updated":"2026-05-15T11:47:00Z","snapshot_observed_at":"2026-08-02T04:56:07.337606Z","submitted_at":"2026-01-29T14:42:46Z","title":"CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-21T14:48:21.787919Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2601.21798"},"observation_digest":"sha256:55832990075a08842a1b804eee5b78a94c3db248db51e0f97ae31f1b384abcd1","observation_id":"91153d93-4a5c-4ad7-9ca3-b01c9c58f090","resolution":{"observed_at":"2026-05-21T14:50:14.890183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.13989","last_updated":"2026-05-21T13:59:18Z","snapshot_observed_at":"2026-08-05T21:34:24.588486Z","submitted_at":"2026-05-13T18:03:07Z","title":"VectraYX-Nano: A 42M-Parameter Spanish Cybersecurity Language Model with Curriculum Learning and Native Tool Use","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:58.483183Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.13989"},"observation_digest":"sha256:b64eddd997a3834ae47af6c78b4b8422267b5cc1577c1afc9e64a50ebd106b7f","observation_id":"5aa45d76-8595-4ff7-b135-eef1d3dfef7b","resolution":{"observed_at":"2026-05-15T05:45:05.576201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.13989","last_updated":"2026-05-21T13:59:18Z","snapshot_observed_at":"2026-08-05T21:34:24.588486Z","submitted_at":"2026-05-13T18:03:07Z","title":"VectraYX-Nano: A 42M-Parameter Spanish Cybersecurity Language Model with Curriculum Learning and Native Tool Use","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T21:02:51.889450Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.13989"},"observation_digest":"sha256:97353c353608329741f695bfda0e737d22b2593e3f33bc815a1e8c6a5faa3d58","observation_id":"4da0c83c-c463-475b-8c3a-4ccd33e04f18","resolution":{"observed_at":"2026-05-20T21:03:46.390770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.13989","last_updated":"2026-05-21T13:59:18Z","snapshot_observed_at":"2026-08-05T21:34:24.588486Z","submitted_at":"2026-05-13T18:03:07Z","title":"VectraYX-Nano: A 42M-Parameter Spanish Cybersecurity Language Model with Curriculum Learning and Native Tool Use","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T09:29:30.950904Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.13989"},"observation_digest":"sha256:bd409d30781b117355ddb9961e76795b1dad5f5c62af82f7fd78740035ebb8ca","observation_id":"331735e9-43e3-47b6-941d-60a359b6b60a","resolution":{"observed_at":"2026-05-22T09:31:22.762383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.18750","last_updated":"2026-05-18T17:59:18Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:18Z","title":"A Readiness-Driven Runtime for Pipeline-Parallel Training under Runtime Variability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T07:35:32.225708Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.18750"},"observation_digest":"sha256:483522082e469c9d3d927d83807d1550648255d8efb99f023534c6fa1e8e128b","observation_id":"638b18c9-252e-4496-99a5-a2168512e572","resolution":{"observed_at":"2026-05-20T07:38:09.371957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.20798","last_updated":"2026-05-20T06:43:34Z","snapshot_observed_at":"2026-08-02T17:01:43.729235Z","submitted_at":"2026-05-20T06:43:34Z","title":"Most Transformer Modifications Still Do Not Transfer at 1-3B: A 2020-2026 Update to Narang et al. (2021) with Downstream Evaluation and a Noise Floor","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-21T06:15:47.451870Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.20798"},"observation_digest":"sha256:e3ca63ad024517413cf42d31c589ab674bd8a5cfd7a98afe257aa0878feec541","observation_id":"927da818-1663-4882-bffc-704ad517ecdf","resolution":{"observed_at":"2026-05-21T06:19:42.020874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.23961","last_updated":"2026-05-12T10:54:09Z","snapshot_observed_at":"2026-08-01T12:46:18.664702Z","submitted_at":"2026-05-12T10:54:09Z","title":"Multimodal Alignment and Preference Optimization for Zero-Shot Conditional RNA Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-30T22:17:56.029187Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.23961"},"observation_digest":"sha256:0c673c63fcafa1bb01b8350d729a31970e8d5907b21118e5a676ba3e2e2899d8","observation_id":"3e286a78-b870-4567-b118-a7e7fdb8cb3f","resolution":{"observed_at":"2026-07-01T14:05:46.871113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.29691","last_updated":"2026-07-02T11:32:18Z","snapshot_observed_at":"2026-07-06T23:39:05.858969Z","submitted_at":"2026-05-28T09:52:52Z","title":"Unsupervised Semantic Segmentation Facilitates Model Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T08:37:02.350175Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.29691"},"observation_digest":"sha256:10740d2c75cb332c40691073a10bd55b19ddb34d1450421026512ad46750e25e","observation_id":"5f9f321a-8d8f-4e16-8130-897384d7fcbb","resolution":{"observed_at":"2026-06-29T08:43:15.473340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2605.29691","last_updated":"2026-07-02T11:32:18Z","snapshot_observed_at":"2026-07-06T23:39:05.858969Z","submitted_at":"2026-05-28T09:52:52Z","title":"Unsupervised Semantic Segmentation Facilitates Model Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-04T00:34:21.224797Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2605.29691"},"observation_digest":"sha256:d7759c9159a32ac922d8359769a94aad6af6052bf48715a413aa1d812718de8b","observation_id":"d3d629c8-08dc-4f13-bf64-2fd1098ce959","resolution":{"observed_at":"2026-07-04T00:39:16.375380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2606.02794","last_updated":"2026-06-01T18:59:01Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T18:59:01Z","title":"Scaling Laws for Neural-Network Quantum States","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T11:30:23.893472Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2606.02794"},"observation_digest":"sha256:fc63fc7bedf9eb7e85f5cbc21e6af1bd4471e0931728ca3caaf78756424cc57c","observation_id":"81530ff2-576f-4bfc-a440-8cc5e3d12828","resolution":{"observed_at":"2026-07-02T01:46:27.071592Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2606.15054","last_updated":"2026-06-29T22:04:02Z","snapshot_observed_at":"2026-08-03T01:16:15.417885Z","submitted_at":"2026-06-13T01:51:05Z","title":"Size Doesn't Matter: Cosine-Scored Sparse Autoencoders","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-01T07:15:16.674714Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2606.15054"},"observation_digest":"sha256:bf5a097111ba4935069d457414c988e0c17f544c53fa686eb84882e67ed7afe0","observation_id":"3a7d2d8c-ea92-4925-b702-774037e804a7","resolution":{"observed_at":"2026-07-01T07:15:29.697712Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":"2302.05442","doi":"10.48550/arxiv.2302.05442","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023.doi: 10.48550/arXiv.2302.05442","venue":"arXiv (Cornell University)","work_id":"41e6d3bd-fb27-453a-b13d-f48551c5f957","year":2023},"citing_paper":{"arxiv_id":"2606.25971","last_updated":"2026-07-17T13:42:08Z","snapshot_observed_at":"2026-08-02T10:13:56.529128Z","submitted_at":"2026-06-24T15:40:26Z","title":"Improving Neural Network Training by Decoupling the Magnitude and Direction of Weight Vectors","version":1},"reference_index":160,"source":"arxiv_source","source_observed_at":"2026-06-25T20:05:09.179627Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2606.25971"},"observation_digest":"sha256:2fd227c62a0132e720a13d0d4b0ee6bbc60f57d0ad1aac000cfb67b952297ba6","observation_id":"694d21cb-4f0c-46e9-aa13-177c648bdd48","resolution":{"observed_at":"2026-07-04T20:30:07.807239Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-02T10:14:05.666991Z","title":"Scaling vision transformers to 22 billion parameters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.25971","last_updated":"2026-07-17T13:42:08Z","snapshot_observed_at":"2026-08-02T10:13:56.529128Z","submitted_at":"2026-06-24T15:40:26Z","title":"Improving Neural Network Training by Decoupling the Magnitude and Direction of Weight Vectors","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T10:14:05.666991Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2606.25971"},"observation_digest":"sha256:98a99e91549bbfe4dd795a52124a66b635dd54ff7ab196f9fb8250111350579f","observation_id":"3244b7a8-17a5-4b57-bf6b-2bc2a95d06ae","resolution":{"observed_at":"2026-08-02T10:14:05.666991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-02T06:13:51.944737Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13125","last_updated":"2026-07-18T17:28:17Z","snapshot_observed_at":"2026-08-03T17:18:33.842709Z","submitted_at":"2026-07-14T17:52:05Z","title":"Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T06:13:51.944737Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2607.13125"},"observation_digest":"sha256:86a8f78c77e76917c2684eef929da88ffebe8a673e4e602feaf7766a158f8e11","observation_id":"fc1682b5-aa53-4aed-9792-b9fe167a72bb","resolution":{"observed_at":"2026-08-02T06:13:51.944737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-07-30T23:56:38.595543Z","title":"Dehghani, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23377","last_updated":"2026-07-25T21:46:48Z","snapshot_observed_at":"2026-08-08T03:10:59.978936Z","submitted_at":"2026-07-25T21:46:48Z","title":"Predict before you train: Scaling Laws for particle physics foundation models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T23:56:38.595543Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2607.23377"},"observation_digest":"sha256:4d8544871f0ba4a7088907d7a68a4cbb6431ae735231b15be11b688c14cfe268","observation_id":"6d2c0ac0-df7d-4e71-92ba-38b944d8b4a7","resolution":{"observed_at":"2026-07-30T23:56:38.595543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-06T00:40:38.653520Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01034","last_updated":"2026-08-04T01:57:33Z","snapshot_observed_at":"2026-08-07T23:09:42.763660Z","submitted_at":"2026-08-02T06:43:25Z","title":"Opt.Gear Technical Report","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:38.653520Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2608.01034"},"observation_digest":"sha256:f6cc42415834e60d5cb99907690352bad9e5ea1bb398140db17f91d455c24444","observation_id":"a09046c1-03fd-451d-91a8-f87589e196ff","resolution":{"observed_at":"2026-08-06T00:40:38.653520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05442","snapshot_observed_at":"2026-08-04T15:20:15.447616Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02091","last_updated":"2026-08-03T11:50:06Z","snapshot_observed_at":"2026-08-08T01:20:23.329247Z","submitted_at":"2026-08-03T11:50:06Z","title":"One QK Channel, Many Sources: Guarding Low-Precision Attention Collapse","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T15:20:15.447616Z"},"links":{"cited_paper":"/paper/2302.05442","citing_paper":"/paper/2608.02091"},"observation_digest":"sha256:3c8fa608378163a5ec2c92fe8169ced805bc3fb13bb73e6b448598f381cdbaff","observation_id":"698ecde2-46b1-494a-b9a0-6406481878e0","resolution":{"observed_at":"2026-08-04T15:20:15.447616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.05442/citation-record","integrity":"/paper/2302.05442/integrity","json":"/paper/2302.05442/citation-record.json","paper":"/paper/2302.05442"},"outbound":[],"paper":{"arxiv_id":"2302.05442","last_updated":"2023-02-10T18:58:21Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T12:07:24.626442Z","submitted_at":"2023-02-10T18:58:21Z","title":"Scaling Vision Transformers to 22 Billion Parameters"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2302.05442."}